加入收藏 | 设为首页 | 会员中心 | 我要投稿 应用网_扬州站长网 (https://www.0514zz.com/)- 科技、建站、经验、云计算、5G、大数据,站长网!
当前位置: 首页 > 站长资讯 > 动态 > 正文

DeepMind想放个大招:让机器像人类一样说话

发布时间:2016-09-12 19:02:18 所属栏目:动态 来源:TechWeb.com.cn
导读:【TechWeb报道】9月12日消息,谷歌旗下人工智能公司DeepMind近来憋了个大招,继AlphaGo赢了人类棋手后,他们又研制出了能

TechWeb报道 9月12日消息,谷歌旗下人工智能公司DeepMind近来憋了个大招,继AlphaGo赢了人类棋手后,他们又研制出了能够生成模仿人类语音的系统。

http://upload.techweb.com.cn/2016/0912/1473640502408.jpg

据外媒介绍,该系统让机器说话与人类说话之间的差距缩小了50%。DeepMind将这个系统命名为Wavenet。

让人能与机器对话一直是人类希望在人工智能领域里实现的目标。但是,目前用计算机生成语音仍然大量地依赖于TTS(文本到语音)拼接技术。在这个过程中,机器首先要记录一个说话人的声音片段,并基于此构建超大型的数据库,随后,经过再次结合过程,形成完整的表达。

WaveNet改变了这种旧范式,它直接对原始声音信号的声浪建模,每次对一个样本进行建模。和生成更加自然的语音一样,使用原始的声波意味着WaveNet能对任何音频建模,其中包括音乐。

研究人员称WaveNet能知道自己说的是什么。首先,研究人员通过把文本转化成一个语言与声学特征序列(这个序列包含了当下的声音、字母、词汇等),然后把这一序列喂到WaveNet中,从而能让模型了解到自己要说什么。

DeepMind是一家专注于人工智能的公司,于2010年成立于伦敦,并在2014年被谷歌以4亿英镑(约合5.32亿美元)收购。随后,DeepMind就获得了使用谷歌数据的权利,这对于他们训练自己的系统意义重大。这次训练WaveNet的数据用的就是谷歌TTS数据库。

训练结束后,研究人员可以把网络数据作为样本,产生合成的表达,进行取样,然后用到下一个步骤的预测中。

据外媒报道,目前谷歌还没有推出关于WaveNets的任何商业应用,因为它需要巨大的计算能力。语音正在成为人类和机器互动中越来越重要的手段,目前亚马逊、苹果、微软和谷歌都在投资能让用户通过语音进行交互的个人数字助理。DeepMind的这项技术也受到了来自各方面的关注。(王卡卡)

(编辑:应用网_扬州站长网)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!