机器说“我爱你”可能比男票的能动听

TechWeb · 公众号 · 科技媒体 · 2016-09-12 12:55

正文

【TechWeb报道】9月12日消息，谷歌旗下人工智能公司DeepMind近来憋了个大招，继AlphaGo赢了人类棋手后，他们又研制出了能够生成模仿人类语音的系统。

据外媒介绍，该系统让机器说话与人类说话之间的差距缩小了50%。DeepMind将这个系统命名为Wavenet。

让人能与机器对话一直是人类希望在人工智能领域里实现的目标。但是，目前用计算机生成语音仍然大量地依赖于TTS（文本到语音）拼接技术。在这个过程中，机器首先要记录一个说话人的声音片段，并基于此构建超大型的数据库，随后，经过再次结合过程，形成完整的表达。

WaveNet改变了这种旧范式，它直接对原始声音信号的声浪建模，每次对一个样本进行建模。和生成更加自然的语音一样，使用原始的声波意味着WaveNet能对任何音频建模，其中包括音乐。

研究人员称WaveNet能知道自己说的是什么。首先，研究人员通过把文本转化成一个语言与声学特征序列（这个序列包含了当下的声音、字母、词汇等），然后把这一序列喂到WaveNet中，从而能让模型了解到自己要说什么。

DeepMind是一家专注于人工智能的公司，于2010年成立于伦敦，并在2014年被谷歌以4亿英镑(约合5.32亿美元)收购。随后，DeepMind就获得了使用谷歌数据的权利，这对于他们训练自己的系统意义重大。这次训练WaveNet的数据用的就是谷歌TTS数据库。

训练结束后，研究人员可以把网络数据作为样本，产生合成的表达，进行取样，然后用到下一个步骤的预测中。

据外媒报道，目前谷歌还没有推出关于WaveNets的任何商业应用，因为它需要巨大的计算能力。语音正在成为人类和机器互动中越来越重要的手段，目前亚马逊、苹果、微软和谷歌都在投资能让用户通过语音进行交互的个人数字助理。DeepMind的这项技术也受到了来自各方面的关注。

推荐文章

新浪科技 · 【#AppleWatch十周年##苹果或举办AppleWatch-20241106084350

昨天

新浪科技 · 【#中国联通以不存在业务阻碍携号转网# #中国联通涉嫌克扣携号转-20241106093746

昨天

36氪 · 甜啦啦，是不是蜜雪冰城的最强对手？

1 周前

新浪科技 · 【#超100名科学家建议叫停星链发射# #马斯克星链五年多发射6-20241031183147

1 周前

新浪科技 · #中欧电动汽车关税案始末#【#中国反击欧盟对华电动汽车关税案#】-20241031110004

1 周前

程序员大咖 · 假如我是一行代码（程序员必备）

7 年前

机器之心 · 学界 | 谷歌新论文提出批再规范化：可降低批规范化模型中的minibatch依赖

7 年前

青塔 · 浙江大学获捐1亿元，成立睿医人工智能研究中心！

7 年前

第一财经YiMagazine · 从知乎live、得到专栏到微博问答，知识变现在中国好像有希望了？ | CBNweekly封面故事

7 年前

DeepTech深科技 · 人体细胞内温度竟可达50°C，远超体温

7 年前