DeepMind想放个大招：让机器像人类一样说话

2016-09-12 21:59:29

9月12日消息，谷歌旗下人工智能公司DeepMind近来憋了个大招，继AlphaGo赢了人类棋手后，他们又研制出了能够生成模仿人类语音的系统。

据外媒介绍，该系统让机器说话与人类说话之间的差距缩小了50%。DeepMind将这个系统命名为Wavenet。

让人能与机器对话一直是人类希望在人工智能领域里实现的目标。但是，目前用计算机生成语音仍然大量地依赖于TTS（文本到语音）拼接技术。在这个过程中，机器首先要记录一个说话人的声音片段，并基于此构建超大型的数据库，随后，经过再次结合过程，形成完整的表达。

WaveNet改变了这种旧范式，它直接对原始声音信号的声浪建模，每次对一个样本进行建模。和生成更加自然的语音一样，使用原始的声波意味着WaveNet能对任何音频建模，其中包括音乐。

研究人员称WaveNet能知道自己说的是什么。首先，研究人员通过把文本转化成一个语言与声学特征序列（这个序列包含了当下的声音、字母、词汇等），然后把这一序列喂到WaveNet中，从而能让模型了解到自己要说什么。

DeepMind是一家专注于人工智能的公司，于2010年成立于伦敦，并在2014年被谷歌以4亿英镑(约合5.32亿美元)收购。随后，DeepMind就获得了使用谷歌数据的权利，这对于他们训练自己的系统意义重大。这次训练WaveNet的数据用的就是谷歌TTS数据库。

训练结束后，研究人员可以把网络数据作为样本，产生合成的表达，进行取样，然后用到下一个步骤的预测中。

据外媒报道，目前谷歌还没有推出关于WaveNets的任何商业应用，因为它需要巨大的计算能力。语音正在成为人类和机器互动中越来越重要的手段，目前亚马逊、苹果、微软和谷歌都在投资能让用户通过语音进行交互的个人数字助理。DeepMind的这项技术也受到了来自各方面的关注。（王卡卡）

　　免责声明：本网站内容由网友自行在页面发布，上传者应自行负责所上传内容涉及的法律责任，本网站对内容真实性、版权等概不负责，亦不承担任何法律责任。其原创性以及文中陈述文字和内容未经本站证实，对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺，并请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益，请及时联系我们，本站将会在24小时内处理完毕。

发布者:sophia

司机抗议游行！美国Uber启动谈判计划协商补偿协议摩拜单车或许生死难料但这可能是未来交通会有的样子

		自动登录	找回密码
密码			立即注册

DeepMind想放个大招：让机器像人类一样说话

相关阅读

相关分类

热门关注