跳到正文
原文
ElevenLabs:Blog(网页)·· 2026-05-28精选AI 评分62

ElevenLabs 发布 Dubbing v2 AI 配音模型,保留原始情感表演并支持 90+ 语言

Introducing Dubbing v2

AI 导读

ElevenLabs 发布 Dubbing v2 AI 配音模型,通过直接以原说话者的表演为条件生成语音,保留语气、节奏、停顿和情感意图,并同步适配到 90+ 语言的口语表达。

推荐理由

原文说明了模型直接基于原表演生成配音的思路,以及面向创作者、营销团队和工作室的不同入口,可用于判断是否替代现有配音流程。

正文 · AI 翻译

今天我们推出 Dubbing v2,这是我们革命性的全新 AI 配音模型。

首次实现了原说话人的情感和表演能够跨越每一种语言。Dubbing v2 不再仅凭转录文本生成平淡、割裂的音频,而是直接以原始表演为条件——保留语气、节奏、表达方式和情感意图。

这解决了 AI 配音领域最大的未解难题之一:让翻译后的语音听起来就像原说话人本人所说。

在 90 多种语言中保留原始表演

传统的 AI 配音系统严重依赖转录文本。虽然这可以产生准确的翻译,但生成的音频往往会丢失那些让人类语音显得自然的细微之处。情感、时机、强调、犹豫和能量,仅凭文本很难重建。

Dubbing v2 以不同的方式解决这一问题。通过直接以原始表演为条件,模型捕捉说话人的语调和语气,并将其跨语言迁移。结果是配音听起来明显更加自然、富有表现力,同时忠实于原始表达。

为自然的多语言表达而打造

好的配音不只是直接翻译。不同的语言需要不同的措辞、节奏和句式结构才能听起来自然。Dubbing v2 会为口语表达调整翻译,同时保持与原始内容的同步。其同步感知翻译系统会自动对齐起止和节奏,减少手动调整的需要,使最终输出更接近专业制作的配音。

让高质量配音触手可及

专业配音每分钟可能花费数百美元,且通常需要涉及翻译、配音演员、剪辑师和音频工程师的大型制作流程。

Dubbing v2 将这一流程自动化。创作者和企业现在无需构建复杂的工作流或协调多个供应商,即可制作高质量的多语言内容。

面向创作者:用听起来自然的视频触达全球受众

对创作者而言,Dubbing v2 让他们可以在 ElevenCreative 中一键本地化 YouTube 视频和其他内容。视频现在可以在各种语言中听起来自然,同时保留原创作者的个性和表达方式。这让全球分发显著更快、更易实现,而无需牺牲质量。

伴随此次发布,我们还推出了 Creator Dubbing Partner Program。符合条件的创作者将获得 Dubbing v2 的折扣使用权限。在此申请。

面向营销人员:大规模本地化营销活动

对营销团队而言,Dubbing v2 能够跨国际市场实现高质量本地化,而无需从头重建营销活动。广告、产品视频和品牌内容现在可以在各种语言中保持相同的情感冲击力和表达风格。ElevenCreative 端到端支持完整的本地化工作流,帮助团队更高效地扩展多语言营销活动。

面向工作室和广播机构:专业配音工作流

对工作室、广播机构和企业级制作而言,ElevenProductions 将 Dubbing v2 与专业本地化服务相结合。这包括人工翻译、专业配音选角和专业音频混音,而 Dubbing v2 负责底层的语音生成和同步。

其结果是可扩展的工作流程,适用于专业级多语言制作。了解更多。

免费开始使用

Dubbing v2 今日已在 ElevenCreative 中上线,并可通过 ElevenProductions 使用。在接下来的 7 天内,你可以免费开始使用,我们的 Free 计划提供 1 分钟免费使用时长,Starter 计划提供 15 分钟,Creator+ 计划提供 30 分钟。

API 访问即将推出,请联系销售团队了解更多。

来源:ElevenLabs:Blog(网页) · elevenlabs.io