Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Seedream Seedance 关键帧交付工作流指南
2026/07/27

Seedream Seedance 关键帧交付工作流指南

Seedream Seedance 工作流先确定构图、光线,再交付给视频模型处理运动。了解两个阶段的职责分工与成本节省。

文本到视频生成有一个结构性问题,任何提示词都无法解决:改变一个细节就会重写整个场景。调整光线,角色的脸就会变。修复面部,背景就会移动。每次迭代都是新的生成。

解决方案是停止让一个模型做两项工作。先用图像模型锁定帧,然后将批准的帧交付给视频模型作为参考。这就是 Seedream Seedance 工作流,其价值不在于每次生成的质量更高。而在于批准变成了持久的。

简要总结

  • 两个阶段,两个模型。 Seedream 5.0 Pro 确定场景的样子。Seedance 处理运动。
  • 交付是一个参考图像,不是重新描述。批准的帧作为 image_urls 传入。
  • Seedream 支持多达 10 个参考,带锚定编辑和多语言排版在 2K 分辨率。
  • 在静态图像上廉价迭代,重新生成只需几分钱和几秒,而不是几美元和几分钟。
  • 先审批运动再修改细节。 一旦摄像机运动正确,剩下的修复就是局部的。
  • 一些分层工作流声明经不起检查。 我们在 实际交付的内容 中分别讨论了它们。

解耦为什么有效

两阶段管道:图像模型确定构图、光线、几何和排版,然后将一个批准的关键帧交付给视频模型,视频模型负责摄像机路径、速度和节拍

视频生成在两个方面都很昂贵:每次调用的成本比图像更高,耗时足够长,使得不好的结果会浪费真实时间。通过那个循环推送每个创意决定是团队报告花费大部分日程进行返工的原因。

分离管道改变了每次迭代的成本。

第一阶段很便宜且快速。 构图、光线、产品几何、排版、品牌色彩。这些是静帧决定,在图像模型上确定它们意味着每次尝试只花几分钱并在几秒内返回。

第二阶段继承一个已确定的帧。 运动生成从已批准的内容开始,而不是从段落重新推导场景。更少变量移动,所以更少东西出错。

经济论证很直接:昂贵的调用应该运行一次,在廉价调用消除了不确定性之后。

第一阶段:确定帧

Seedream 5.0 Pro 是资产步骤。对交付重要的是:

多达 10 个参考图像,带锚定编辑,所以产品或角色可以被固定而不是被描述。

2K 分辨率的多语言排版,保留确切的颜色和布局,当帧携带必须存活进视频的品牌文本时很重要。

像素预算计费,在 2.36M 像素处分割。16:9 的 2048×1152 帧落在更便宜的层级,这恰好是大多数关键帧的正确尺寸。详情见 定价分解

这个阶段的输出不是一个选项文件夹。它是每个镜头一个批准的帧,加上产生它的提示。

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedream-5-0-pro",
    "prompt": "product hero on a stone counter, soft window light from camera left, brand wordmark legible on the label",
    "image_urls": ["https://example.com/packshot.jpg"],
    "size": "2048x1152"
  }'

第二阶段:交付帧

交付是人们做错的部分。本能是在视频提示中再次描述批准的帧。那重新引入了第一阶段移除的歧义。

传递帧本身:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "0-5s: [locked medium] no camera movement, steam rises from the cup. 5-12s: [slow dolly in] 0.3 m/s, product stays centered. Do not add text or logos.",
    "image_urls": ["https://cdn.example.com/approved-keyframe.png"],
    "resolution": "1080p",
    "duration": 12
  }'

注意视频提示做了什么,没做什么。它描述运动和约束。它没有重新描述光线、构图或产品,因为参考帧已经携带了那些。

这个分工就是纪律。关键帧中可见的任何东西都属于关键帧,不属于运动提示。

每个阶段负责什么

决定阶段为什么
构图和取景图像便宜迭代,昂贵修复
光线方向图像如果仅在视频提示中描述就会漂移
产品几何和徽标图像由参考锚定而不是生成
排版和品牌文本图像文本渲染最强的地方
摄像机路径和速度视频运动是视频模型的工作
时序和节拍视频时间戳结构属于运动
否定约束两者文本抑制在每个阶段都重要

产生最多混淆的行是光线和取景。两者都感觉像它们属于视频提示,因为那是最终输出来自的地方。把它们放在那里意味着在每次生成时重新决定它们。

节省实际来自哪里

围绕这个工作流浮动的 60% 更快迭代声明是营销数字,不是测量。其下面的机制是真实的,不过值得明确说明而不是作为百分比。

一个被拒的静画成本一个图像生成。 一个被拒的视频成本一个视频生成加等待。

一个批准的静画是可重用的。 同一个关键帧可以驱动几个运动变体,不同时长,不同摄像机移动,无需重新生成场景。

局部编辑保持局部。 在关键帧上修复高光不会扰乱你已经批准的摄像机移动,因为运动还没有生成。

第三点是团队很晚才发现的。排序批准,使便宜的决定先确定,不是生产力技巧,这就是使昂贵调用值得进行的原因。

管道在哪里破裂

在视频提示中重新描述帧。 最常见的错误。它给视频模型许可来重新解释已经确定的内容。

在错误的纵横比批准关键帧。 在视频将使用的纵横比下生成静画。将 1:1 关键帧裁剪成 16:9 镜头重新引入取景决定。

跳过"简单"镜头的静画。 简单镜头恰好是静画最便宜的地方,所以节省比例最高。

将参考视为建议。 如果输出从关键帧漂移,添加明确约束将视频绑定到它,而不是重写描述。

常见问题

为什么使用两个模型而不是一个文本到视频调用?

因为文本到视频调用每次都重新推导整个场景,所以改变一个细节会改变一切。先确定帧使批准在迭代中持久。

两个阶段之间传递什么?

批准的关键帧作为参考图像,加上运动提示。视觉描述不会重复。

视频提示应该描述光线吗?

不。关键帧中可见的任何东西都属于关键帧。运动提示涵盖摄像机路径、时序和约束。

关键帧应该是什么纵横比?

与视频将使用的相同的。在不同比例生成静画并裁剪重新引入你已经做出的取景决定。

一个关键帧可以驱动几个视频吗?

是的,这是大部分价值。不同时长、摄像机移动和切版可以共享批准的帧而无需重新生成场景。

这对多镜头序列有效吗?

是的。批准每个镜头一个关键帧,然后从其自己的参考生成每个镜头的运动。跨镜头的一致性来自静画共享参考,而不是一个长提示。

关于这个工作流的分层输出声明准确吗?

几个广泛重复的规格在官方能力表上经不起检查。我们在 实际交付的内容 中检查了它们。

排序批准,不仅仅是生成

Seedream Seedance 工作流被描述为质量技术,它实际上不是。两个模型是否链接都产生它们产生的东西。

链接改变的是决定变成最终的顺序。构图、光线和品牌细节在成本只有几分钱的表面上确定。运动生成一次,对抗没有人仍在争论的帧。管道值得为那个原因单独建立,报告最大收益的团队是那些更早移动批准的,而不是那些找到更好提示的。

参考资料

  1. 火山引擎。Seedream 和 Seedance 模型族。 检索于 2026 年 7 月 volcengine.com

进一步阅读