返回所有模型

ElevenLabs / Voice

ElevenLabs.
赋予故事它的声音。

ElevenLabs 提供将文本转为口语音频的语音生成模型。它属于 AI 视频工作流的声音层:旁白、角色对白和本地语言轨。配音需要传达与其所伴随场景相同的意图。

在故事中Voice
虚构人物 Anaya 与 Kabir 在一张暖色灯光的桌子两侧相对而坐。
AI Director 的镜头简介相同的意图,用另一种语言表达。
01 / 剧本

批准含义、语域和角色名称。

02 / 配音

在目标语言中试演所选声音。

03 / 时间安排

将停顿和台词长度适配到场景剪辑。

虚构故事概念。说明性插图,不是所示模型的输出。

Model capabilities

ElevenLabs 为配乐带来了什么

文本到语音
使用选定语音从剧本生成口语音频。
多语言语音
支持的模型覆盖多种语言。语言可用性和配音的适用性因模型与音轨而异。
配音与表现选择
选择声音和针对模型的控制可塑造表达。请试读实际台词,而不要只依赖通用样本。

功能描述的是模型家族,而不是保证每个版本或控制在 Tosheo 中都可用。制作端的接入取决于提供者的可用性、参考、权利和获批范围。

02 / ElevenLabs

ElevenLabs 在你的叙事中处于何处

ElevenLabs 适用于旁白、对白稿和语言轨制作。Tosheo 的 AI Director 可以将剧本与角色声音、发音指导和相关剪辑连接起来。本地语言审查会检查含义和语域以及台词的听感,因此翻译仍然是叙事决策的一部分。

Fictional example相同的意图,用另一种语言表达。

Kabir 轻声说出 Anaya 的名字。改编台词时保持犹豫与两人关系的完整性。

剧本
批准含义、语域和角色名称。
配音
在目标语言中试演所选声音。
时间安排
将停顿和台词长度适配到场景剪辑。

03 / ElevenLabs

规划 ElevenLabs 的移交

AI Director 根据场景计划准备配音请求,使用 AI Skills 指定取景、表演或声音意图。你可以审查创意准备,或在你选定的范围内使用 Auto 模式。模型会收到一个有边界的任务,包含对该素材重要的参考和约束。

对于独立创作者,这把创意决策与下一步制作衔接起来。对于出版方,它把重复使用的素材与分集计划关联。品牌买家可以将已批准的产品参考带入镜头;制作公司可以在序列中保留处理说明和移交要求。

04 / ElevenLabs

一个身份,多种语言

已批准的语音参考在权威性上等同于一张面孔。它随角色而行、被每个镜头继承,改变它需要复核。

与声音相关的特定部分在于身份必须能经受住语言变更的考验。这就是为什么语言轨在绿灯时就要声明:在批准前需要针对每个已声明的轨道选定声音,而不是事后再去寻找第二种声音来匹配一个从未为之选角的表演。

  1. 01
    在绿灯阶段申报语言轨道

    在绿灯阶段定义主要语言及任何附加轨道。批准前确认所选配音在每个轨道上都可行。

  2. 02
    为所有音轨配音进行试配。

    只在一种语言中成立的人物形象在制作开始前就已经失败。

  3. 03
    将发音记录为正典

    姓名、地名、区域用语和语域。在质检中核对,而不是在每次场次中重新决定。

  4. 04
    以母语审查每条语言轨。

    每条轨都有一个指定审批人。印地语审查员不能替泰米尔语签字。

  5. 05
    按片段级别修复

    一句发音错误的台词是一个音频片段,不是一个轨道,也不是一集。

05 / ElevenLabs

清楚陈述的许可规则

  • 未经经核实许可,不得克隆真实人物的声音
  • 未获得经核实许可,任何类型均不得使用名人肖像或声音
  • 不得在授权所覆盖的地域、期限或平台之外使用该声音
  • 不得制作欺骗性证词
  • 在需要披露为合成媒体的地方,不得移除合成媒体声明

当许可存在时,它会像其他授权一样被记录其领土、期限、平台和到期日;其中到期是系统保存的日期,而不是期望某人在两年后记得的事项。

06 / ElevenLabs

在实际场景中评估一个语音模型

供应商文档

功能以官方来源为核对基础。故事类应用是 Tosheo 的编辑示例,而非对比基准测试。

ElevenLabs 文本转语音文档

制作前的问题

我可以克隆我自己的声音吗?

在经核实的许可下——就你自己的声音而言,意味着须验证其确为你本人——可以,而且该授权会记录地域、期限和到期日。验证步骤不是可以跳过的形式主义,仅因为请求者听起来很自信。

如何防止角色在另一种语言中听起来不同?

通过在批准前,把配音与每个声明的语言轨进行角色选定,而不是在完成的首个表演上去匹配第二个声音。这是最决定地区语言轨是否可行的单一决策,而且是在绿灯阶段做出的。

谁纠正读错的名字?

发音指导为 canon,因此修正是对 canon 的更正加上对受影响音频片段的有针对性修复。画面、其他音轨和本集的其余部分不受影响。

合成媒体披露会应用到音频吗?

披露义务附属于交付物,并在交付包中进行核查。对于上线的连载制作,字幕和合成媒体披露默认开启。

你们会为所有语音使用同一个语音供应商吗?

分配会考虑每个语言音轨的覆盖和发音可信度,因此一部作品可以为不同音轨使用不同的供应方。所使用的任何供应方都会记录在每个已接受素材的来源信息中。

AI Director + AI Skills + Models

模型生成素材。你的 AI Director 连接故事。

  1. 01

    您的指导

    分享 brief、格式、分集计划和目标语言。

  2. 02

    AI 导演

    使用 AI Skills 构建分镜、参考资料和镜头级别的指导。

  3. 03

    模型契合度

    将素材与可用模型及已批准的制作范围匹配。

  4. 04

    故事就绪素材

    在情境中检视结果,修复需要关注的部分并组装剪辑。

自行审查创意准备,或在所选范围内使用自动模式。费用授权、权利清理和最终交付验收仍需明确决定。

More from the model library

继续讲好这个故事。

Tosheo / AI-native production

从场景开始。
让导演把它衔接起来。

查看 Tosheo 如何将委托说明、AI Skills、生成与审核整合进一个制作流程。