红联Linux门户
Linux帮助

百度发布Deep Speech 嘈杂环境下识别率超谷歌苹果

发布时间:2014-12-19 11:31:26来源:红联作者:Fasten
来源:环球科技

据美国《福布斯》杂志12月18日报道,自2013年5月人工智能专家、“谷歌大脑之父”吴恩达(Andrew Ng)担任百度首席科学家起,他就携数名百度人工智能实验室的研究人员专注于语音识别技术的研究。18日,百度宣布了吴恩达和其团队的首个研究成果----深度学习语音识别系统Deep Speech。

美国康奈尔大学开放存取资源库arXiv.org发布的一篇文章称,吴恩达携10人组成的百度研发团队研究出一种更准确的语音识别技术。吴恩达说,Deep Speech深度学习语音识别技术能够超越苹果和谷歌相关的语音识别技术。

吴恩达指出,Deep Speech的优势是,在类似人群或是车内嘈杂的环境下能够实现将近81%的辨识准确率,优于谷歌的语音识别引擎(Google API)、Wit.AI、微软Bing语音搜索、苹果语音服务等。美国卡内基梅隆大学的助理研究员Ian Lane对此表示,百度的该项成果有望打破语音识别的发展格局。

据悉,百度人工智能研发团队共收集了超过9600人、长达7000多小时的语音数据资料,大多数是安静环境中的语音,但百度公司还加入了15种嘈杂环境中的语音样本,如在饭馆、汽车、地铁等。

在被问到何时会将Deep Speech语音识别系统应用到其他研究和服务中时,吴恩达显得很谨慎,并未透露过多,但从言辞中可知,这一天不会太远。据猜测,Deep Speech很有可能应用于百度Cool Box产品中。

尽管百度目前主要服务的还是中国市场,但是百度公司目标成为全球顶尖的互联网公司,因此其将Deep Speech打造成全球性的语音识别系统,将会加入外语语音、翻译等其他功能。
文章评论

共有 0 条评论