热搜: 佳士科技irobot开云电竞官网下载app机器人ABB机器人产业联盟发那科机械手机器人展览码垛机器人

VALL-E:微软全新文字转语音模型可以在三秒钟内复制任何人的声音

日期:2023-01-10 来源:cnBeta 评论:0
标签: 微软 大数据 科技
  自从第一个文本到语音(TTS)模型发布以来,研究人员一直在寻找让计算机系统产生语音的方法,微软的最新模型VALL-E是在这方面的一个重要进步。VALL-E是一个基于转换器的TTS模型,只需听到三秒钟的声音样本就能生成任何声音的语音。这比以前的模型有很大的改进,以前的模型需要更长的训练时间才能生成新的声音。
  对于计算机行业来说,VALL-E是一项惊人的技术壮举,有可能改变我们与数字媒体互动的方式。语音的音调、魅力和风格都在生成的语音中保持不变,这是在使TTS系统听起来更自然方面迈出的重要一步。
  微软会不会基于这项技术有更多运用目前还不清楚,然而,微软已经发布了该模型的几个实例,很明显,这是TTS技术的一个重大进步。
微信图片_20230110090057
  您可以在这里收听范例:
  https://mpost.io/vall-e-microsofts-new-zero-shot-text-to-speech-model-can-duplicate-everyones-voice-in-three-seconds/
声明:凡开云电子链接 来源注明为其他媒体来源的信息,均为转载自其他媒体,并不代表本网站赞同其观点,也不代表本网站对其真实性负责。您若对该文章内容有任何疑问或质疑,请立即与开云客户(www.www.wykobounce.com)联系,本网站将迅速给您回应并做处理。
电话:021-39553798-8007
更多> 相关开云电子链接
0 相关评论

推荐图文
推荐开云电子链接
点击排行
Baidu
map