AI精确复制声音真假“比尔·盖茨”难辨
2022-03-02 09:22:13 来源:
【网易智能讯6月14日消息】脸书的研究人员成功克隆了微软总裁比尔·盖茨的声音。
脸书人工智能研究中心的肖恩·瓦斯奎兹(Sean Vasquez)和迈克·刘易斯(Mike Lewis)于本周表示,他们已经努力模仿人类语言有一段时间了。然而,模仿人类语言显然是件难事,当人们听到斯蒂芬·霍金所使用的那套最著名的说话机器发声时,会发现它听起来仍然很不像人类。
但是现在,研究员们似乎已经取得了进展。如果你听了盖茨的克隆所发出的声音,我想你是会同意的。因为它听起来很像比尔·盖茨,你甚至很难分辨出它和他真实声音的区别。
研究人员展示了他们的研究。在这里,机器模仿着盖茨的腔调发声,“请给你珍爱的朋友发一封充满爱意的短信。”其中最不可思议的是,这台机器在说“珍爱(cherish)”时,准确无误地捕捉到盖茨不断上升的语调变化的。
这项技术被称为MelNet,可以用来复制人类的语调。到目前为止,盖茨和其他许多人的声音都被它完美地再现了。瓦斯奎兹和刘易斯说,克隆的音频取自各类Ted演讲。
两位研究人员还表示,直到最近,文本到语音转换软件还不能很好地工作的原因是它使用了波形图记录声音。这些图显示了声音在几秒钟内的音阶变化。如果你听到过盖茨说“珍爱”这个词,就知道他的语气是变化剧烈的。在试图模仿一个人的时候,深度学习机器必须预测到所有这些细微的变化,这很不容易。
瓦斯奎兹和刘易斯说,他们通过使用一种叫做光谱图的东西来训练机器,成功地克隆了声音。
研究人员说!“光谱图的时间轴比波形图的时间轴紧凑几个数量级,这意味着在波形中跨越数万个时间步长的依赖关系在光谱图中只跨越数百个时间步长。这使得我们的光谱图模型能够在数秒内记录各种语音和音乐样本,并保持它们一致性。”
不过,他们也经历了一些挫折。研究小组表示,对他们来说,几乎完美地复制一个句子并不难,难的是复制那些在长达几十秒或几分钟的时间里,显示了情绪变化的复杂语调”。尽管如此,当涉及到人机交互时,研究小组说,在只涉及简短对话的情境中,这项技术可能会带来革命性的变化。(选自:SiliconANGLE作者:James Farrell编译:网易智能 参与:毅立)
-
AI精确复制声音真假“比尔·盖茨”难辨
【网易智能讯6月14日消息】脸书的研究人员成功克隆了微软总裁比尔·盖茨的声音。 脸书人工智能研究中心的肖恩·瓦斯奎兹(Sean
2022-03-02 09:22
-
在中国,“酸臭”的净化器越来越多,为什么
因为钱。图片源自网络 那个酸臭味简直了,之前六月份公司搬家,特地买的除甲醛版的 ****,而且是 24 小时全天开机,根本不停,用不
2022-03-02 07:50
-
供暖季皮肤干燥?双11试试小米系这款智米纯净型加湿器
秋冬季节的明显特点就是空气干燥,而空气干燥带来的问题,除了表面的皮肤干燥缺水,更重要的是会引发人体内部器官的缺水和不适。因此秋
2022-03-02 04:59
-
中国量子计算研究获重大进展,发表于《科学》杂志
(原标题:中国量子计算研究获重大进展) (量子计算示意图,与内外无关) 本报北京8月9日电(周炜、余建斌)浙江大学、中科
2022-03-02 03:48
-
天玑81008000什么水平天玑81008000性能规格参数
联发科今日正式发布轻旗舰 5G 移动平台天玑 8100,主打「出色能效,卓越体验」。 天玑 8100 采用台积电 5nm 制程,CPU 部分包
2022-03-02 03:06