02 / Veo
Veo 在你的故事中扮演什么角色
Veo 适合用来表现氛围、场景开场和需要将画面与环境音结合的动作场面。Tosheo 的 AI Director 可以将镜头的构图、位置参考和声音意图带入请求,然后将结果与周围序列进行比对。
Anaya 听到身后有脚步声。让站台足够安静,以便那个声音能改变场景。
- 画面
- 在揭示 Kabir 之前保持全景构图。
- 声音
- 遮篷下的雨。脚步从后方进来。
- 故事
- 让声音在画面出现前先提示某人。
03 / Veo
规划 Veo 的移交
AI Director 根据场景计划准备视频请求,使用 AI Skills 指定取景、表演或声音意图。你可以审查创意准备,或在你选定的范围内使用 Auto 模式。模型会收到一个有边界的任务,包含对该素材重要的参考和约束。
对于独立创作者,这把创意决策与下一步制作衔接起来。对于出版方,它把重复使用的素材与分集计划关联。品牌买家可以将已批准的产品参考带入镜头;制作公司可以在序列中保留处理说明和移交要求。
04 / Veo
它被路由到什么用途
Veo 是 Google 的一类文本与图像转视频产品,其对制作系统的关键特性是同时生成画面和音频。下游的所有环节都必须考虑到这一点。
在 Tosheo 中,路由器会将其视为需要生成音频的镜头——如环境声、偶发声音,或画面与声音必须同时生成的时刻。但对于那些角色声音已被确认为正典的制作中的对话镜头,它并不自动成为正确的目标,因为正典声音的存在本身就是为了保留正典声音。
- 模态
- 带有同步音频的视频。
- 典型流转路径
- 声音属环境效果而非表演,或画面与声音需一起开发的镜头。
- 分配约束
- 如果镜头包含已批准的角色对白,配音轨就是规范资产,模型生成的音频不能替代它。
- 权利限制
- 供应商条款必须符合交付物要求,且带有模型限制的参考素材可能会完全排除某个供应商。
05 / Veo
Veo镜头对制作的需求。
这是在版本之间不变的部分,这也是本页不以版本为主的原因。
一次生成请求只包含提供给它的制作上下文。它不知道门在两个镜头前位于镜头左侧,不知道绷带是在第三集中加上的,不知道这个角色还没读那封信,也不知道品牌禁止某些并列。每次调用都是独立的,而独立性正是一个连续剧季无法容忍的。
- 固定角色需要明确的身份参照。
- 它不知道场景之前已经确定的地理设置。
- 它不记录角色已知或拥有的事物。
- 参考一致性需要对返回结果单独核查。
- 它不能清理权利、授权预算或接受镜头。
这并非对模型的批评。它是对模型职责终点的描述,也是制作系统存在于其之上的原因说明。
06 / Veo
上文中仍然适用的事项
- 01镜头继承正典,而不是描述。
在单元发出前,身份参考、服装状态、场景地理、故事状态和配音轨会被附加上去。
- 02路由器界定任务范围
供应商选择受授权费用上限、权利条款以及该镜头所需携带的参考素材是否受模型支持等因素约束。
- 03处理一经批准即被锁定。
一个季不会悄悄跟随供应商的更新。采用新版本是一个带有版本边界的决策。
- 04结果会与参考进行核对
视觉与叙事续贯性,以及对话、发音、字幕与披露的一并把关。
- 05有名的人工接受者
生成的镜头在获授权人员为预期交付接受之前没有价值。
供应商文档
功能以官方来源为核对基础。故事类应用是 Tosheo 的编辑示例,而非对比基准测试。
Google Veo 开发者指南制作前的问题
Tosheo 使用 Veo 吗?
分配基于能力和对特定交付物的可接受性,并且供应方随市场变化而变化。我们不发布会很快过时的固定名单,而是说明如何对这类供应方进行分配以及其管理规则。你制作中使用的供应方会在每个镜头的来源信息中记录,因此你始终可以查知。
我可以坚持使用特定模型吗?
你批准一个处理方案,实际上是固定在一致性重要的范围内的供应商和参数。这个层面上的选择才有意义。按镜头挑选供应商是让一季看起来像六个不同剧目的可靠方法。
如果模型生成音频,我还需要声音规范吗?
对于任何会重复出现的角色,答案是肯定的。每个镜头都重新生成的声音等同于面容漂移,而这会在观众需要识别人物的场景中最明显地失败。已批准的声音参考用于确保角色在一个季度内以及不同语言轨上听起来像同一个人。
当较新版发布时会怎样?
除非有人另有决定,否则没有变化。已锁定的处理不会跟随供应商更新,因为一季中某集在中途悄然改变外观或声音会造成具有技术原因的连贯性故障。采用新版本是在版本边界处的有作用域的决定。
Tosheo 是一个 Veo 的封装器吗?
不。正史、权利、批准、修复谱系和交付保存在任何供应商之外,这就是制作可移植的原因。换用不同模型仅改变像素的供应方,不改变角色身份或已批准内容。
