依图科技与微软、华为共同拓展语音市场

2018-12-11 18:17:53爱云资讯

人工智能公司依图科技公布了在中文语音识别技术上的最新突破。在全球最大的中文开源数据库AISHELL-2中,依图短语音听写的字错率(CER)仅为3.71%。依图还联合微软Azure推出依图语音开放平台,并携手华为发布“智能语音联合解决方案”,将依图领先的语音识别技术提供给广泛的第三方应用开发者,共同推动智能语音行业的进步。


依图首席创新官吕昊博士

对语音识别来说,语速、语态、语气、口音等都会显著影响识别的准确率。一般认为,字错率在低于3%时不会影响可读性,而超过15%则毫无可读性。这两个数据可认为是语音识别的两条红线,而在不同场景下,不同算法的表现可能会有很大差异。在中文语音识别技术领域,汉语的博大精深带来的同音不同意等问题,更对语音识别的处理难度带来极大挑战,显著影响最终的使用体验。

依图首席创新官吕昊博士表示,“语音识别技术经历了漫长的发展进化,但至今都只能在受限的场景下才能达到较好的使用效果。我们认为,核心技术的突破,依然是当前破局中文语音识别发展的关键。在语音识别领域,依图科技是一名新生,但立志推动行业创新与发展,做世界最好的中文普通话语音识别技术。”

中文语音识别机器和人还有差距,产业发展任重道远

基于在语音识别领域的技术突破,依图与微软也宣布进一步深化合作伙伴关系,联合推出依图语音开放平台。该平台将基于微软Azure云,将行业领先的语音识别技术能力开放给广泛的第三方应用开发者,并携手为广大用户和客户提供更全面的服务及更好的体验。在联合发布语音开放平台之后,依图与微软还将在智能语音领域展开更深层次的合作,共建AI生态。

依图还携手华为联合发布“智能语音联合解决方案”,该方案基于依图语音开放平台及华为全栈全场景昇腾(Ascend)系列芯片和面向数据中心侧的Atlas 300 AI加速卡,将双方强大的技术研发能力与生态服务能力深度结合,形成软硬件一体化的联合解决方案。借助该解决方案,第三方应用开发者可进一步提升开发效率,从业界领先的语音技术中受益。

语音识别是AI理解世界最重要的组成部分,也是人人交互、人机交互最重要的入口。此次依图科技在语音识别技术方面的突破,不仅意味着依图首次涉足语音识别领域便已经跻身中文语音识别第一阵营,同时也说明语音识别在技术层面还有足够的进化空间,远远没有达到“超越人类”。依图预计,在未来6个月到12个月,语音识别技术的算法性能将呈指数级增长,更多的场景将被解锁,为行业应用带来更大的价值。
相关文章
热门文章
头条文章
重点文章
推荐文章
热点文章
关于我们|联系我们|免责声明|会展频道
冀ICP备2022007386号-1 冀公网安备 13108202000871号 爱云资讯 Copyright©2018-2023