返回所有模型

Google / Video

Google Veo.
画面与声音匹配。

Veo 是 Google 的视频生成系列。它可以将书面场景或参考图像转成带声音的动态影像。对于叙事类内容,这就打开了让雨声、脚步声和环境音融入同一镜头的可能性。

在故事中Video
虚构人物 Anaya 与 Kabir 在一个被雨水浸湿的铁道站台上。
AI Director 的镜头简介末班列车已离开。
01 / 画面

在揭示 Kabir 之前保持全景构图。

02 / 声音

遮篷下的雨。脚步从后方进来。

03 / 故事

让声音在画面出现前先提示某人。

虚构故事概念。说明性插图,不是所示模型的输出。

Model capabilities

Veo 为画面带来什么

文本与图像到视频
描述一个场景或提供一张图像以指导起始构图,然后围绕该方向生成运动。
画面之外的声音
支持的 Veo 模型生成同时包含环境音和对白的视频音频。仍需核查声音身份和发音。
以参考为主导的镜头
根据所选版本,参考图像、首帧与末帧以及视频延伸提供了塑造镜头的额外方式。

功能描述的是模型家族,而不是保证每个版本或控制在 Tosheo 中都可用。制作端的接入取决于提供者的可用性、参考、权利和获批范围。

02 / Veo

Veo 在你的故事中扮演什么角色

Veo 适合用来表现氛围、场景开场和需要将画面与环境音结合的动作场面。Tosheo 的 AI Director 可以将镜头的构图、位置参考和声音意图带入请求,然后将结果与周围序列进行比对。

Fictional example末班列车已离开。

Anaya 听到身后有脚步声。让站台足够安静,以便那个声音能改变场景。

画面
在揭示 Kabir 之前保持全景构图。
声音
遮篷下的雨。脚步从后方进来。
故事
让声音在画面出现前先提示某人。

03 / Veo

规划 Veo 的移交

AI Director 根据场景计划准备视频请求,使用 AI Skills 指定取景、表演或声音意图。你可以审查创意准备,或在你选定的范围内使用 Auto 模式。模型会收到一个有边界的任务,包含对该素材重要的参考和约束。

对于独立创作者,这把创意决策与下一步制作衔接起来。对于出版方,它把重复使用的素材与分集计划关联。品牌买家可以将已批准的产品参考带入镜头;制作公司可以在序列中保留处理说明和移交要求。

04 / Veo

它被路由到什么用途

Veo 是 Google 的一类文本与图像转视频产品,其对制作系统的关键特性是同时生成画面和音频。下游的所有环节都必须考虑到这一点。

在 Tosheo 中,路由器会将其视为需要生成音频的镜头——如环境声、偶发声音,或画面与声音必须同时生成的时刻。但对于那些角色声音已被确认为正典的制作中的对话镜头,它并不自动成为正确的目标,因为正典声音的存在本身就是为了保留正典声音。

模态
带有同步音频的视频。
典型流转路径
声音属环境效果而非表演,或画面与声音需一起开发的镜头。
分配约束
如果镜头包含已批准的角色对白,配音轨就是规范资产,模型生成的音频不能替代它。
权利限制
供应商条款必须符合交付物要求,且带有模型限制的参考素材可能会完全排除某个供应商。

05 / Veo

Veo镜头对制作的需求。

这是在版本之间不变的部分,这也是本页不以版本为主的原因。

一次生成请求只包含提供给它的制作上下文。它不知道门在两个镜头前位于镜头左侧,不知道绷带是在第三集中加上的,不知道这个角色还没读那封信,也不知道品牌禁止某些并列。每次调用都是独立的,而独立性正是一个连续剧季无法容忍的。

  • 固定角色需要明确的身份参照。
  • 它不知道场景之前已经确定的地理设置。
  • 它不记录角色已知或拥有的事物。
  • 参考一致性需要对返回结果单独核查。
  • 它不能清理权利、授权预算或接受镜头。

这并非对模型的批评。它是对模型职责终点的描述,也是制作系统存在于其之上的原因说明。

06 / Veo

上文中仍然适用的事项

  1. 01
    镜头继承正典,而不是描述。

    在单元发出前,身份参考、服装状态、场景地理、故事状态和配音轨会被附加上去。

  2. 02
    路由器界定任务范围

    供应商选择受授权费用上限、权利条款以及该镜头所需携带的参考素材是否受模型支持等因素约束。

  3. 03
    处理一经批准即被锁定。

    一个季不会悄悄跟随供应商的更新。采用新版本是一个带有版本边界的决策。

  4. 04
    结果会与参考进行核对

    视觉与叙事续贯性,以及对话、发音、字幕与披露的一并把关。

  5. 05
    有名的人工接受者

    生成的镜头在获授权人员为预期交付接受之前没有价值。

供应商文档

功能以官方来源为核对基础。故事类应用是 Tosheo 的编辑示例,而非对比基准测试。

Google Veo 开发者指南

制作前的问题

Tosheo 使用 Veo 吗?

分配基于能力和对特定交付物的可接受性,并且供应方随市场变化而变化。我们不发布会很快过时的固定名单,而是说明如何对这类供应方进行分配以及其管理规则。你制作中使用的供应方会在每个镜头的来源信息中记录,因此你始终可以查知。

我可以坚持使用特定模型吗?

你批准一个处理方案,实际上是固定在一致性重要的范围内的供应商和参数。这个层面上的选择才有意义。按镜头挑选供应商是让一季看起来像六个不同剧目的可靠方法。

如果模型生成音频,我还需要声音规范吗?

对于任何会重复出现的角色,答案是肯定的。每个镜头都重新生成的声音等同于面容漂移,而这会在观众需要识别人物的场景中最明显地失败。已批准的声音参考用于确保角色在一个季度内以及不同语言轨上听起来像同一个人。

当较新版发布时会怎样?

除非有人另有决定,否则没有变化。已锁定的处理不会跟随供应商更新,因为一季中某集在中途悄然改变外观或声音会造成具有技术原因的连贯性故障。采用新版本是在版本边界处的有作用域的决定。

Tosheo 是一个 Veo 的封装器吗?

不。正史、权利、批准、修复谱系和交付保存在任何供应商之外,这就是制作可移植的原因。换用不同模型仅改变像素的供应方,不改变角色身份或已批准内容。

AI Director + AI Skills + Models

模型生成素材。你的 AI Director 连接故事。

  1. 01

    您的指导

    分享 brief、格式、分集计划和目标语言。

  2. 02

    AI 导演

    使用 AI Skills 构建分镜、参考资料和镜头级别的指导。

  3. 03

    模型契合度

    将素材与可用模型及已批准的制作范围匹配。

  4. 04

    故事就绪素材

    在情境中检视结果,修复需要关注的部分并组装剪辑。

自行审查创意准备,或在所选范围内使用自动模式。费用授权、权利清理和最终交付验收仍需明确决定。

More from the model library

继续讲好这个故事。

Tosheo / AI-native production

从场景开始。
让导演把它衔接起来。

查看 Tosheo 如何将委托说明、AI Skills、生成与审核整合进一个制作流程。