首页 > 科技 >

依图科技发布语音开放.. 联袂微软、华为撬动语音市场

2018-12-11 22:44:24 网络整理 阅读:113 评论:0

腾讯科技讯 12月11日,人工智能公司依图科技公布了在中文语音识别技术上的最新突破。在全球最大的中文开源数据库AISHELL-2中,依图短语音听写的字错率(CER)仅为3.71%,领先原业内领军者约20%,刷新现有纪录。依图还联合微软Azure推出依图语音开放..,并携手华为发布“智能语音联合解决方案”,将依图领先的语音识别技术提供给广泛的第三方应用开发者,共同推动智能语音行业的进步。

依图科技发布语音开放.. 联袂微软、华为撬动语音市场

依图首席创新官吕昊博士

语音识别技术远未成熟 技术透明度差

近年来,深度学习的爆发驱动了语音识别技术的高速发展,但相较于人脸识别在准确率方面的高增速来说,语音识别的发展仍较为缓慢。尽管一些机构已宣传达到了人类水平,但大多数情况下都来自安静、近场等受限场景。对于电话、语音节目、远场等更复杂场景,则需要针对性地开发不同模型,但实际应用中的不确定性,使理想和现实仍有较大差距,导致应用场景难以得到更大突破。

对语音识别来说,语速、语态、语气、口音等都会显著影响识别的准确率。一般认为,字错率在低于3%时不会影响可读性,而超过15%则毫无可读性。这两个数据可认为是语音识别的两条红线,而在不同场景下,不同算法的表现可能会有很大差异。在中文语音识别技术领域,汉语的博大精深带来的同音不同意等问题,更对语音识别的处理难度带来极大挑战,显著影响最终的使用体验。

依图首席创新官吕昊博士表示,“语音识别技术经历了漫长的发展进化,但至今都只能在受限的场景下才能达到较好的使用效果。我们认为,核心技术的突破,依然是当前破局中文语音识别发展的关键。在语音识别领域,依图科技是一名新生,但立志推动行业创新与发展,做好的中文普通话语音识别技术。”

依图科技发布语音开放.. 联袂微软、华为撬动语音市场

讯飞依图等各家算法差异巨大 讯飞依图具有优势

相关文章