VALL-E一种用于文本到语音合成 (TTS) 的语言建模方法。具体来说,我们使用从现成的神经音频编解码器模型派生的离散代码来训练神经编解码器语言模型(称为 VALL-E),并将 TTS 视为条件语言建模任务,而不是像以前的工作那样连续信号回归。在预训练阶段,我们将 TTS 训练数据扩展到 60K 小时的英语语音,这是现有系统的数百倍。VALL-E 出现了上下文学习能力,可用于合成高质量的个性化语音,只需录制 3 秒的未见过的说话者的注册录音作为声音提示。实验结果表明,VALL-E 在语音自然度和说话人相似度方面明显优于最先进的零样本 TTS 系统。此外,我们发现 VALL-E 可以在合成中保留说话者的情绪和声音提示的听觉环境。
类似的工具
免费AI 中文社
AI 中文社区 - 一个学习交流 AI 人工智能技术的中文社区
WritePass官网
系统通过对文本进行解析帮助写作者了解论文的抄袭情况,提高本科论文、硕士论文、博士论文、期刊发表论文等的原创水平
PromptPerfect
将你的提示词提升到完美
Resemble.ai
Resemble.ai的AI语音生成器是一个完整的生成式语音AI工具包,允许您在几秒钟内创建类似人类的声音。
Getfloorplan
Getfloorplan 可随时创建 2D、3D 平面图和 360° 虚拟游览。使用我们的材料,您的普通房源可以变成您客户的梦想之家图片
AI伪原创
一款智能SEO写作工具,AI润色内容,让写作更高效
他人最近看的工具
AI伪原创
一款智能SEO写作工具,AI润色内容,让写作更高效
WritePass官网
系统通过对文本进行解析帮助写作者了解论文的抄袭情况,提高本科论文、硕士论文、博士论文、期刊发表论文等的原创水平
PromptPerfect
将你的提示词提升到完美
VEED.IO
为专业人士提供的在线视频套件
Resemble.ai
Resemble.ai的AI语音生成器是一个完整的生成式语音AI工具包,允许您在几秒钟内创建类似人类的声音。
durable
节省工作时间,让 Durable AI 在 30 秒内创建可创收的网站。
AI 中文社
