你用过手机的语音输入功能吗?想象一下,不论你的普通话是否标准,甚至不管你说的是哪里的方言,手机都能轻松识别,这会不会是人机语言交互的又一次极大推进?
日前举办的全国人机语音通讯学术会议上,百度语音技术部负责人贾磊展示的这种语音识别技术,引起了业界人士的普遍关注。
“我们最新研发的语音识别技术,可使识别相对错误率比现有技术降低15%以上,使安静环境下普通话的语音识别率接近97%。”贾磊说。
为了提高语音识别能力,研究人员在算法上进行了创造革新,传统的语言识别技术,都必须把建模单元分成多个独立的状态,而百度研发团队此次却开创性地使用了整体建模,模型的单元可以采用声韵母、音素、音节,甚至可以相互混合。再结合百度自身拥有的大数据平台基础,才有了此次重大突破。
依靠云端的“极致计算”,未来在短时间内即可实现声音的个性化识别。用户每次使用语音识别都会进一步完善自己账户的“模型”,使得这个“模型”更趋近于自己的个性特征。根据贾磊的设想,这个语音识别系统经过一段时间的“训练”,不论你说的是东北话、上海话,还是粤语、湖南话,甚至最难懂的温州话,机器都可以准确识别。