Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Seedance 2.5 摄像机:数字而非形容词
2026/07/27

Seedance 2.5 摄像机:数字而非形容词

Seedance 2.5 摄像机控制对描写词失效,因为形容词映射到快速默认运动。用明确的速度数值、命名刚体设备和时间戳节拍替代心情词,精确控制摄像机路径。

生成一个 30 秒镜头,在 prompt 里写"流畅的电影般的推镜",虚拟镜头就会像失控的无人机一样冲过房间。主体被留在模糊里。这是 Seedance 2.5 摄像机控制最常见的单一挫折,它不是 bug。

形容词不是速度。这个模型把描写词映射到默认运动向量,而 smoothepicdramatic 这样的词映射到快速的。修正它意味着要像剧本监督而不是心情板一样写 prompt。

TL;DR

  • 用数字替代形容词。 "以每米 2 秒的速度横向推轨"胜过"快速跨房间推镜"。
  • 命名刚体。 Dolly、crane、locked tripod、tracking shot。机械词汇约束运动模型的方式是心情词做不到的。
  • 把镜头分成时间戳节拍,这样引擎就知道运动什么时候开始、保持和停止。
  • 用参考素材锚定空间,而不是描述它,这就是阻止坐标漂移的原因。
  • 更长的生成漂移更多。 30 秒窗口使显式约束更加必要,而不是更少。

为什么默认太快

这个模型在压缩的潜在空间中工作,文本线索在任何渲染之前就被映射到速度向量。通用描述符没有物理重量,所以映射倾向于扫过的、高加速的轨迹。

随之而来三种失败模式,它们在长镜头中复合。

语义鸿沟。 "Smooth" 和 "dramatic" 不是速度指标。神经网络权重把它们读成最大加速的许可,而不是审慎运动的指令。

潜在漂移。 没有硬约束,空间坐标在扩展的时间线上漂移。第 3 秒时在左边的墙在第 20 秒时在其他地方。

节奏崩溃。 快速默认翻译摧毁了前几秒钟观众方向感,这是决定有没有人继续看的部分。

用数字替代形容词

这就是整个技术,下表是它的工作版本。

失败模式避免改用
超快推镜"Smooth, epic camera pan across the room""Lateral tracking shot at 0.5 m/s, fixed focal length, 4-second linear progression"
失控变焦"Dramatic cinematic zoom into the subject""Gradual focal push-in from wide (24mm) to medium (50mm) over a 10-second window"
坐标漂移"Fast drone shot flying over the landscape""Low-altitude stable aerial glide, altitude locked at 3 meters, vector heading 090"

从那些行可以推广出三条规则。

定义数字速度。 用每秒米数或每米秒数替代每个描写词。两者都行。重要的是出现一个数字。

锁定机械刚体。 明确说出 dolly、crane、locked tripod 或 tracking shot。命名真实设备会强制运动模型朝向物理上可信的路径,因为那些词带有空间约束而"cinematic"没有。

加上时间触发器。 把长镜头分成阶段,这样引擎就知道何时运动何时保持。

时间戳节拍

一个 30 秒的 Seedance 镜头分成四个时间戳节拍,每个都有明确速度,对比形容词对比数字 prompt 改变

30 秒窗口就是 prompt 结构停止可选的地方。单个段落描述整个镜头给模型没有理由在任何点保持静止,所以它持续运动。

改为节拍结构:

0-6s: [Locked tripod] Medium shot, subject centered, no camera movement.
      Ambient motion only — steam rising, fabric shifting.
6-14s: [Slow dolly in] Push from medium to close at 0.3 m/s, constant speed,
      no easing. Focal length fixed at 50mm.
14-22s: [Hold] Camera static at close range. Subject turns toward the lens.
22-30s: [Lateral track left] 0.4 m/s, subject remains centered in frame,
      background parallax reveals the window.

结构给你两样东西。每个节拍有明确速度,所以没有段继承默认值。而保持被声明而不是暗示,这就是阻止模型用运动填充沉默的原因。

锚定空间而不是描述它

参考素材是最强的控制面,它因为感起来像额外工作而被低估。

用文本描述房间给模型一个房间的概率分布。提供参考给它几何。对于摄像机工作特别是,这个区别决定了墙在 20 秒运动中是否保持。

实际层级,最强优先:参考 视频 的摄像机运动你想回响,然后是静帧建立从镜头会经过的角度建立的空间,然后是文本描述这两个都不覆盖的东西。文本是备选,不是基础。

这也与 2.0 生成的计费交互,其中提供上传的视频会把请求移到更便宜费率。当管道已经是视频驱动时值得知道。

故障排除

每个运动上都有运动模糊。 速度对于帧率太高无法解析。切割数字速度而不是在 prompt 里加"less blur",模型把它读成风格备注而不是物理约束。

摄像机在长镜头中漂离主体。 加入一个取景约束到每个节拍:"subject remains centered"、"subject occupies the left third"。取景是每个节拍的属性,在顶部说一次不会生存到 25 秒。

运动前它应该开始。 没有明确保持的节拍被解释为运动的邀请。声明静态段。

每个生成看起来不同尽管提示词相同。 空间被重新发明了每次运行。那是参考素材问题,不是 prompt 问题。

调用它

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "0-6s: [Locked tripod] medium shot, no camera movement. 6-14s: [Slow dolly in] push to close at 0.3 m/s, focal length fixed 50mm. 14-22s: [Hold] static, subject turns to lens. 22-30s: [Lateral track left] 0.4 m/s, subject centered.",
    "resolution": "1080p",
    "duration": 30
  }'

加上参考素材来锚定几何:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "Match the camera move in the reference. Subject remains centered throughout.",
    "video_urls": ["https://example.com/camera-reference.mp4"],
    "image_urls": ["https://example.com/set-wide.jpg", "https://example.com/set-close.jpg"],
    "resolution": "1080p",
    "duration": 30
  }'

媒体输入是公网 http(s) URL 仅,没有 base64 接受。当前费率和完整请求面在 reapi.ai/models/seedance-2-5

FAQ

为什么 Seedance 默认这么快移动摄像机?

因为描写词映射到默认速度向量,通用描述符解决为高加速。形容词不是速度指标。

我如何精确指定摄像机速度?

用一个数字和一个单位。"0.5 m/s" 或 "2 seconds per meter" 都约束模型;"slow" 不。

时间戳 prompt 格式是什么?

把镜头分成时间范围,每个都有一个括号刚体类型、一个明确速度和一个取景约束。声明保持以及运动。

我如何阻止摄像机漂离我的主体?

在每个节拍而不是在顶部一次放一个取景约束。取景不会自己跨长镜头持续。

参考素材对摄像机控制有帮助吗?

是的,比 prompt 措辞更有帮助。一个参考视频其运动你想回响是最强锚,其次是建立空间的静帧。

为什么相同 prompt 给不同摄像机路径?

因为空间被每次运行重新派生。提供参考几何而不是用文本描述房间。

什么导致生成镜头中的运动模糊?

速度对于帧率太高无法解析。降低数字速度而不是要求更少模糊。

指导而不是描述

修正 Seedance 2.5 摄像机控制的心理转变小而具体。停止写镜头应该感觉什么样,开始写刚体做什么:哪个设备、以多快的速度、多久、何时保持、取景如何。

摄像机 prompt 中的每个形容词是一个决定交给会解决为运动的模型。每个数字是一个你保留的决定。更长的生成使那个权衡更尖锐,因为 30 秒未约束解释比 5 秒漂移更远。写节拍,命名刚体,给它几何来保持,输出停止成为彩票。

参考

  1. Volcano Engine. Seedance and the Doubao video model family. Retrieved July 2026 from volcengine.com

进一步阅读