GLM-5.2 is live — Z.AI's flagship with a 1M-token lossless contextfrom $0.900 每 1M tokens
Dreamina Seedance 2.5 用户指南:30 秒与长视频模式
2026/08/02

Dreamina Seedance 2.5 用户指南:30 秒与长视频模式

Dreamina Seedance 2.5 通用教程,含 30 秒生成、视频延长、长视频、时间戳、参考素材、编辑、音频清理与故事板实例。

要理解 Dreamina Seedance 2.5,最好把它看成一套制作工作流,而不是一个单独的文本框。 你可以生成最长 30 秒的完整场景,把符合条件的源视频延长成更长的段落,用 Ultra Long Video 规划最长 180 秒的项目,以时间戳指挥事件,组合多模态参考素材,还能只修正指定区域,而不必从头重生成。[1]

真正实用的能力,是为每个镜头选择刚好够用的工作流。如果这是你的第一条 AI 视频,可以直接从下方的 8 秒“复制后改写”示例开始;如果你已经在做专业制作,同一套方法可以扩展成节拍表、素材清单、连续性锁定、分轮编辑和逐场审核。本文的每个主要工作流都有可复用的示例,并告诉你常见失败该怎么修。

TL;DR:先选工作流,再写提示词

  • 一个地点、一个主要事件,并且大约 3–5 个连续节拍能在 30 秒内完成时,使用标准生成
  • 现有视频已经具备正确的人物、构图、环境和运动时,使用 Extend Video。Dreamina 指南要求源视频短于 30 秒,并说明可连续延长到最长 60 秒;延长提示词只控制新增加的片段。[1]
  • 需要最长 180 秒的结构化项目时,使用 Ultra Long Video。要把它规划成共享连续性规则的一组相连场景,而不是一个巨大的段落。
  • 每张图片、每段视频和每段音频只分配一个职责,同时写清它不能控制什么。
  • 持续动作使用时间范围,清晰可见的节拍使用精确时刻,一个事件触发另一个事件时使用相对时间
  • 只需描述结果层面的修改时选 Smart Edit;目标是特定物体或区域时选 Edit with Marks;修改与源视频或时间段绑定时选 Edit Video
  • 每次编辑都写三张清单:修改什么、保留什么、如何验收
  • 把字幕、对白、音效、环境声和 BGM 当成不同音轨。明确要删除哪一层,也明确要保护哪些层。

Seedance 2.5 工作流一览

Dreamina Seedance 2.5 工作流,涵盖生成、延长、时间戳导演、编辑、本地化,以及故事板或 Clay Renderer 空间预演

六个模块解决六类不同的制作问题。Create 建立镜头,Extend 保护跨边界的连续性,Direct 把事件放到时间线上,Edit 只修改最小必要目标,Localize 控制语言和声音,Block 则通过故事板或 Clay Renderer 参考提供空间结构。

新手和专业创作者怎样使用本指南

开始时不需要掌握专业制作术语。新手可以复制最小示例,替换主体和场景,然后生成一段短视频;有经验的创作者可以把同一个示例当作底层模板,再叠加参考素材、分时段节拍、连续性锁定、编辑轮次和正式验收标准。

你的经验从这里开始基线成功后再添加初次使用先跳过
第一条 AI 视频一个主体、一个动作、一个场景、5–10 秒一条镜头指令和一个结束状态大型参考素材包与多场景故事
有一些生成经验15–30 秒节拍表和 1–3 个参考素材音频、精确时间、首尾帧连续性尚未稳定时就做超长项目
专业创作者连续性表、素材清单、场景卡、审核量表分轮编辑、Clay 预演、音频计划、转场设计无需默认跳过任何项,按制作需求选控制项

新手示例:先做一个清楚的 8 秒镜头

复制下面这份完整示例,再把主体、动作和地点替换成你自己的内容。

输入——完整提示词

生成一段 8 秒的写实视频。

一只金毛犬走进阳光充足的厨房,在一个蓝色食盆旁停下,
然后看向镜头。

使用固定机位、平视中景。让狗始终完整出现在画面中。
自然的清晨室内环境声,无对白,无音乐。

结束时,狗站在食盆旁并看向镜头。

它有效的原因:

  • 只有一个主体: 模型不需要同时追踪多个角色。
  • 只有一条动作链: 走入、停下、看向镜头。
  • 只有一个地点: 无需自行补出场景转场。
  • 只有一条镜头规则: 固定中景减少相互竞争的指令。
  • 只有一个结束状态: 生成后可以立刻判断是否通过。

如果狗一直没有走到食盆旁,就缩短入场动作,或删掉“看向镜头”。动作过载时,不要靠堆叠装饰性形容词解决。

进阶版本:在同一个镜头上增加控制

基线成功后,逐项增加控制,而不是把整个提示词推倒重写:

输入——完整提示词

生成一段 12 秒的写实视频。

@Image 1 只定义同一只金毛犬的面部、毛色和红色项圈。
@Image 2 只定义阳光充足的厨房布局和蓝色食盆。
不要继承参考素材中的人物、镜头角度或其他背景物体。

0–5 秒:狗从画面左侧进入,走向蓝色食盆。
结束状态:四只脚都停在食盆旁。

5–9 秒:狗先低头看食盆,然后抬起头。
结束状态:狗头朝向正前方。

9–12 秒:狗看向镜头时,镜头缓慢推进一次。
结束状态:同一只狗和一个蓝色食盆保持在画面中央。

保持同一只狗的外观特征、红色项圈、食盆数量、厨房布局、清晨光线、
运动方向、脚掌接地和自然室内环境声不变。

专业版本增加了身份归属、参考排除项、时间、镜头运动、物体数量和连续性。故事仍然很简单,只是控制更精确了。

按任务查找对应示例

任务本指南中的示例
第一次文生视频上方 8 秒“狗与食盆”示例
用图片参考人物或产品进阶版狗狗示例与素材清单章节
完整 30 秒场景旅行水瓶时间提示词
延续一个已经成功的片段10 秒源视频加 5 秒运动员延长
只修改一个物体标记并替换行李箱
移除字幕或 BGM带保护音轨的清理示例
双人对白Mina 与 Owen 的身份及声音示例
替换绿幕背景雨夜车站合成示例
指导复杂动作Clay Renderer 交接示例
制作长故事180 秒设计师场景卡示例

生成前:先写一页制作简报

一份好的制作简报,比单纯加长提示词更能减少失败。在上传任何参考素材前,先写下所有生成、延长和编辑阶段都必须保持不变的信息。

建立连续性表

连续性项目需要记录什么锁定示例
人物面孔、发型、服装、年龄段、声音Mina 始终是同一张脸、短黑发和橙色夹克
道具形状、颜色、数量、归属者只有一个银色包裹,始终由 Mina 携带
空间入口、出口、相对位置柜台始终在左侧,取件门始终在画面右侧
镜头轴线、高度、方向、运动平视镜头,不越轴
光线方向、颜色、时间柔和晨光从画面左侧照入
音频对白语言、音色、环境声、音乐英语对白、安静店内环境声、无 BGM
开始状态动作前能看到什么Mina 站在门外,右手拿着包裹
结束状态动作后必须看到什么包裹位于柜台中央,双手已经离开

所有锁定项都应该能被观察和验收。“保持电影感”无法核验;“橙色夹克、一个包裹、从左向右运动和清晨光线保持不变”则可以。

创建素材清单

Dreamina 官方提示词指南记录的容量为最多 30 张图片、10 段视频和 10 段音频,总计 50 个素材。视频参考和音频参考各自的合计时长上限为 30 秒。[2] 上限代表容量,不代表推荐的起始用量。

素材唯一职责继承不继承
@Image 1人物身份面孔、头发背景、姿势、服装
@Image 2服装橙色夹克、黑色长裤模特面孔、摄影棚光线
@Image 3地点柜台布局、门口、晨光人物、招牌、商品
@Video 1动作步行速度、交接包裹动作表演者、房间、镜头色彩
@Audio 1声音说话者音色与表达方式样本中的原句

从能够完整定义场景的最小素材集开始。只有在某个新素材能解决一个明确失败时,才把它加进来。

生成前先定义通过条件

所有审核者都应该使用同一套“完成”标准。一份简洁的通过清单可以是:

  1. 每个节拍中出现的都是同一个人物。
  2. 场景里始终只有一个包裹。
  3. 动作顺序与节拍表一致。
  4. 镜头始终位于动作轴线同一侧。
  5. 每句对白都属于正确的说话者。
  6. 最后一帧达到提示词规定的结束条件。

这样就能把凭感觉反复抽卡,变成可重复的审核流程。

在 Dreamina 中启动项目

  1. 打开 Dreamina 官方创作网站,进入 AI Video
  2. 选择 Seedance 2.5,再根据任务选择输入路径:文本、多模态参考、首尾帧、现有源视频、延长或编辑工作流。
  3. 构建参考关系前,先设置时长和宽高比。锚点图片应与目标输出使用相同的宽高比。
  4. 上传最小可用参考素材集,并在提示词中标注每个素材的职责。
  5. 先生成一次,对照通过条件检查结果,再决定是修改提示词,还是做局部编辑。

不要每次失败都继续加文字。身份错误,就修正身份映射;事件顺序错误,就简化节拍表;只有一个物体错误,就编辑该物体,不要重生成整段场景。

在 30 秒、视频延长和 Ultra Long Video 之间选择

这些时长选项对应的是不同制作方法。

工作流指南描述的上限最适合规划单位主要风险
标准生成最长 30 秒一个完整场景分时段节拍一条时间线塞入过多事件
连续延长源视频短于 30 秒;连续延长后最长 60 秒继续一个已经成功的片段边界状态加新增片段接缝处出现明显跳变
Ultra Long Video最长 180 秒多场景故事场景卡与转场人物、道具、光线或音频漂移

在 30 秒内完成一个完整场景

当观众始终处在同一个地点,并跟随一个主要变化时,30 秒最容易控制。先确定你需要的最终画面,再倒推成 3–4 个阶段。

输入——完整 30 秒提示词

[目标]
为一个可重复使用的旅行水瓶制作 30 秒产品故事。

[参考素材]
@Image 1 只定义水瓶形状、哑光蓝色表面和白色 logo 的位置。
@Image 2 只定义厨房布局和清晨窗光。
始终只有一个水瓶。不要继承任一图片中的人物。

[0–7 秒]
一名跑者走进厨房,把盖好的水瓶放在柜台中央。
结束状态:水瓶直立,双手离开水瓶。

[7–16 秒]
跑者打开水瓶,加水,再盖紧瓶盖。
结束状态:瓶盖完全闭合,没有水洒出。

[16–24 秒]
跑者拿起同一个水瓶,走向门口。
结束状态:跑者到达门口,右手拿着水瓶。

[24–30 秒]
跑者把水瓶标签转向镜头,镜头缓慢推进。
结束状态:一个水瓶占据画面中央三分之一,标签清晰可读,跑者停止移动。

[音频]
自然厨房环境声,14 秒时出现瓶盖咔嗒声,无对白,无 BGM。

[保持]
水瓶几何结构、哑光蓝色、logo 位置、跑者身份、服装、
运动方向、厨房布局、清晨光线和镜头轴线不变。

每个时间区间只有一个主要状态变化。如果模型跳过某个事件,先减少动作数量,不要先增加时长。

延长现有视频,同时避免明显跳变

Dreamina 指南给出了明确的 Extend Video 流程,并说明连续延长后的结果最长可达 60 秒:[1]

  1. 在生成流中选择目标片段,打开它的延长控件。
  2. 使用短于 30 秒的原始视频;指南将其列为使用该功能的条件。
  3. 通过界面提供的时长控件、时间线手势或直接数值,设置新增时长。
  4. 只写新增部分需要发生的动作。源视频仍是原片段的主素材。
  5. 生成合并后的结果,重点检查接缝前后几秒。

假设源视频为 10 秒,新增片段为 5 秒。延长指令应描述新增加的 5 秒,而不是重写前 10 秒:

输入——完整延长提示词

把 @Video 1 向后延长 5 秒。

[边界状态]
从源视频最后一帧继续:运动员刚刚落地,膝盖弯曲,
右手触地,低机位镜头正对运动员,场馆内是蓝色灯光。

[新增动作]
运动员起身,直视镜头,平稳地呼吸一次。
不要重复跳跃,也不要再加入一次落地。

[保持]
同一名运动员、服装、接缝处身体姿势、镜头高度、镜头方向、
场馆结构、蓝色光线、动作速度、观众环境声和源视频宽高比不变。

[结束状态]
运动员站在画面中央并看向镜头,双脚都稳稳踩在地面上。

先以正常速度观看接缝,再逐帧检查。核对姿势、画面位置、运动方向、道具数量、光线、焦点、镜头速度、环境声和音量。好的延长首先要匹配边界,新的剧情信息排在第二位。

规划最长 180 秒的 Ultra Long Video 项目

不要把 180 秒提示词写成一个不换气的大段落。把项目拆成场景卡,每张卡都要有进入状态、一个主要事件、退出状态和转场。

场景卡时长进入状态主要事件退出状态转场
1. 工作室0–25 秒设计师走进空工作室拆开原型包装原型位于桌子中央圆形旋钮匹配剪辑
2. 街头测试25–60 秒旋钮充满画面在雨中测试产品产品仍正常工作水滴变成车窗反光
3. 列车60–105 秒列车车窗上的反光设计师查看数据出现绿色结果屏幕光变成晨曦
4. 观景台105–150 秒晨光照在人脸上最终户外测试设计师微笑并收好产品包袋合上并遮满画面
5. 结尾画面150–180 秒包袋合上后的暗画面产品亮相并完成收尾动作产品居中,动作停止保持最终构图

生成前准备四份可重复使用的文档:

  • 一份人物设定表,记录面孔、发型、服装、姿态和声音;
  • 一份道具台账,记录物体外观、数量、归属者和状态;
  • 一套地点规则,记录布局、时间、天气和镜头方向;
  • 一份音频计划,记录对白、环境声、音效、音乐和转场。

先测试最难的场景。如果下雨段落、双人交流或复杂镜头运动单独生成时都无法维持连续性,更长的时间线只会放大问题。

使用多模态参考,但别让它们互相打架

只有职责明确时,多模态输入才真正有用。人物脸部图片、服装图片、动作视频、房间图片和声音样本可以同时工作,因为它们分别控制不同层。

为冲突参考设置优先顺序

当两个素材包含重叠信息时,要明确谁优先:

参考优先级:
1. @Image 1 控制面孔和头发。
2. @Image 2 只控制服装。
3. @Video 1 只控制动作节奏和镜头运动。
4. @Image 3 只控制房间布局和光线。
5. @Audio 1 只控制音色和表达方式。

如果参考素材发生冲突,按以上优先顺序执行。

“把所有参考素材用于人物和风格”约束力很弱。更可控的写法会为每个属性指定归属素材,并排除文件中的无关信息。

让首帧和尾帧保持兼容

首个锚点确定开场构图和输出比例,末尾锚点确定动作必须到达的位置。两者使用相同宽高比,保持主体数量一致,并说明两个状态如何连接。额外的人物或产品参考不能覆盖锚点构图。[2]

用三种时间指令导演时间线

Dreamina 支持基于时间戳的导演控制,但每个时间段仍要安排实际能完成的动作量。[1]

时间方法适合示例
时间范围持续动作或剧情节拍6–12 秒:她打开箱子,取出一台相机
精确时刻一个可见或可听的变化18 秒时,红色实景灯变为蓝色
相对时间因果关系车门关闭两秒后,列车开始移动

建立四轨节拍表

时间画面对白音效与环境声音乐
0–6 秒维修师打开工作室卷帘门声、室内底噪
6–14 秒维修师把一台相机放到工作台上“我们来测试稳定器。”箱扣声低频节拍开始
14–22 秒相机开机,状态灯变色开机提示音低频节拍轻声继续
22–30 秒维修师演示一次平滑横摇“没有抖动。”马达声音乐在 29 秒结束

接着把表格改写成提示词,并为每个时间范围增加可见的结束状态。不要把对白、道具变化、地点变化和复杂镜头运动同时塞进同一个 2 秒区间。

时间戳是导演指令,不是逐帧精确的非线性剪辑承诺。如果关键动作出现得太早,就简化之前的节拍,或改成相对于清晰触发点的时间表达。

选择正确的编辑工作流

Dreamina 将 Smart Edit、Edit with Marks 和 Edit Video 列为不同工作流。[1] 它们都遵循“先保护,再修改”的原则,但解决的问题不同。

工作流最适合提示词必须写明主要审核风险
Smart Edit结果层面的修正目标结果和受保护内容修改范围扩散过大
Edit with Marks单个物体或有边界的区域标记目标、替换内容、边缘、遮挡边缘闪烁或损坏
Edit Video随时间变化的源视频修改主源视频、时间范围、动作、音频锁定时间或动作漂移

Smart Edit:描述结果和边界

当修改结果很容易说清,但又无法限定在一个很小的选区内时,使用 Smart Edit。

输入——Smart Edit 指令

把午后场景改成小雨天气。
只在咖啡馆窗外和室外人行道上添加雨水。
保留两个人物、面孔、头发、服装、桌面物品、室内光线、
对白、镜头运动,以及咖啡馆室内已有的全部反射。
验收:室内不能出现雨,任何人物的外观都不能改变。

Edit with Marks:控制一个物体或区域

标记尽可能小且足够识别的目标。说明替换内容、边缘周围应该出现什么,以及目标被遮挡时应如何处理。

输入——标记物体指令

标记的红色行李箱是唯一可编辑物体。
把它替换成与 @Image 2 一致的一个海军蓝硬壳行李箱。
保持原有大小、运动路径、轮子接地、手部接触、阴影、遮挡关系
和在画面中出现的时间。保留所有人物和全部未标记行李。

Edit Video:让源视频成为主素材

输入——源视频编辑指令

@Video 1 是构图、人物、动作顺序、镜头和音频的唯一主素材。
在 8–12 秒内,只把台灯灯体从白色改成橙色。
同步更新台灯在桌面上的局部光照。
保留面孔、服装、手部动作、桌面结构、镜头运动、对白、
室内环境声,以及 8–12 秒之外发生的所有事件。

官方提示词指南指出,视频编辑会保持源视频比例,并大致保持原时长;因为帧处理,结果可能有约 0.3 秒的小幅差异。[2] 不要只看中间帧,要检查编辑范围的两个边界。

移除字幕、BGM 和不需要的视觉元素

把“音频”或“文字”当成单一层时,清理任务很容易误伤。编辑前先把类别分开。

删除无关字幕,同时保留有用文字

输入——字幕清理指令

只删除 4–9 秒画面底部的字幕行。
重建被字母遮住的地板纹理和移动阴影。
保留店铺招牌、产品标签、墙面海报、面孔、镜头运动、
对白、音效,以及字幕区域之外的所有文字。

检查残留字母、模糊矩形、重复背景纹理,以及镜头运动时的闪烁。

分离或移除 BGM,同时保护人声

编辑前先写一份音频清单:

输入——音频分层指令

音轨操作
对白保留两位说话者和原有时间
音效保留门声、脚步声、放下玻璃杯的声音
环境声保留安静的餐厅室内底噪
BGM整段移除

清理后要听是否出现辅音被截断、音量忽大忽小、环境声丢失或底噪突然变化。如果场景需要音效和室内底噪,“删除所有背景音频”就过于宽泛。

跨时间删除一个物体

局部消除要写清物体、时间范围、移除后露出的背景,以及遮挡行为:

输入——物体删除指令

删除 0–14 秒内的黑色麦克风支架。
重建支架后方的木质舞台地板和蓝色幕布。
歌手经过该区域时,保留位于前景的歌手,只重建被遮住的支架部分。
保留歌手手里的麦克风。

检查完整运动路径。单张静帧看起来干净,运动中仍可能出现残影、边缘跳出或阴影断裂。

转移创意,同时排除不需要的细节

当你把值得借鉴的层单独抽出来时,“Transfer Ideas”最有用,例如动作逻辑、构图、镜头节奏、转场设计或故事结构。不要让源素材控制所有内容。

输入——创意转移指令

[转移]
只继承 @Video 1 的动作顺序:展示物体、环绕一圈、最后停在俯视画面。

[替换]
使用 @Image 1 的陶瓷茶具、@Image 2 的安静摄影棚,
以及下文描述的温暖纸张质感。

[不要继承]
不要继承源素材中的表演者、品牌标记、文字、颜色、房间、产品、
音乐或声音。

审核时检查是否意外带入源素材的人物身份、logo、文字、配色和道具。

改变空间视角,同时保持几何关系

透视编辑需要的是空间关系,而不是凭空编一个焦距数字。把场景分层描述:

  • 前景: 自行车轮穿过画面左下边缘;
  • 中景: 快递员和包裹保持居中;
  • 背景: 门口位于快递员后方约两米处;
  • 观察方向: 镜头从左前方移动到侧面,但不绕到快递员身后;
  • 保持: 身体比例、包裹形状、接地关系、地平线和光线方向。

编辑后检查比例、地平线、消失方向、遮挡顺序、接触阴影和脚是否贴地。仅仅改变观察角度时,物体不应无缘无故改变大小或归属。

控制音色参考和多人场景

为每个人创建档案,并在每句对白中点名说话者,多人物生成会稳定很多。

输入——完整双人提示词

<Mina> = @Image 1 的面孔 + @Image 2 的橙色夹克 + @Audio 1 的声音。
<Owen> = @Image 3 的面孔 + @Image 4 的灰色衬衫 + @Audio 2 的声音。

0–6 秒:Mina 站在画面左侧,Owen 站在画面右侧,两人都保持不动。
Mina 用平静的英语说:{测试现在开始。}

6–12 秒:Owen 用右手按下一个按钮。
Owen 用较低、沉稳的声音说:{供电稳定。}

12–18 秒:Mina 检查显示屏,Owen 的双手始终离开设备。
说话者、声音、服装、位置和动作都不得互换。

使用音色或声音参考时,要说明素材控制的是音色特征、音高范围、语速、情绪还是表达方式。书面对白要单独提供,避免模型误把样本中的原句带进结果。

用绿幕编辑获得更干净的合成

人物轮廓是受保护素材。只改变背景,同时保留面孔、发丝、半透明边缘、服装、姿势、主体大小、运动模糊和动作时间。

输入——绿幕编辑指令

把绿色背景替换成黄昏时下雨的车站站台。
保持表演者轮廓、发丝边缘、透明雨衣、姿势、比例、
步行动作、镜头运动和源视频时长不变。
让新背景的透视和镜头速度与源视频匹配。
从画面右侧添加冷色光,在湿地面加入轻微反射,
并在双脚下添加接触阴影。去除绿边,但不要改变雨衣颜色。

重点检查头发、手指、运动模糊边缘、反光服装、双脚,以及所有穿过人物轮廓的物体。边缘闪动通常在运动中比预览静帧更明显。

使用 Clay Renderer 指导动作和空间预演

Clay Renderer 把简单白模或已预演的 3D 场景变成空间参考。白模控制几何、镜头路径、动作、接触和遮挡;其他参考素材控制最终人物身份、服装、材质、环境和视觉风格。[1]

输入——Clay Renderer 交接提示词

@Video 1 是 Clay Renderer 动作预演参考。
只从 @Video 1 继承双人动作、镜头路径、桌子位置、手部接触
和遮挡顺序。

把角色 A 替换成 <Mina>,角色 B 替换成 <Owen>。
使用 @Image 5 的工作室环境和 @Image 6 的产品材质。
不要继承白色黏土材质、占位人物的面孔、无纹理背景或预演中的临时光线。

保持预演中的行走路径、交接时间、主体比例、镜头方向、
桌面接触和最终位置。

把结果与预演素材对照,检查路径、接触、穿模、比例、镜头方向和遮挡。Clay Renderer 是参考工作流;除非官方明确记录了相应集成,否则不要把它描述成原生 Maya 或 Blender 场景文件集成。

制作无缝转场和多宫格故事板

故事板宫格定义有顺序的视觉状态,但不会自动解释状态之间如何运动。每个画格只负责一件事,并在每对画格之间写一句转场指令。

画格锚点状态转场指令
1厨师在腰间高度拿着闭合的盒子盒子抬向桌面时,镜头跟随移动
2盒子位于桌子中央厨师打开盒盖,镜头靠近但不改变轴线
3盒内产品清晰可见厨师双手离开画面时,产品旋转一圈
4产品占据画面中央光线变柔和,动作逐渐停止并保持最终画面

每个连接点都要定义共享状态:人物位置、朝向、速度、手部姿势、道具归属、镜头方向、光线和环境声。连续动作、构图匹配、前景遮挡和相同形状都可以用作转场方法,但不要把它们当成系统保证可复现的界面预设。

三个端到端工作流示例

示例 1:30 秒产品故事

简报: 展示一个小型音箱在酒店书桌上展开、开机并播放音乐。

素材: 产品正面、侧面和背面图片;一张酒店房间参考;一段展开动作视频;一段开机提示音。

流程: 每张图片只对应一个产品视角,编写三个分时段节拍,把音箱数量锁定为一个,并写明最后的标签朝向。先生成基线,再增加镜头运动。

审核: 产品几何、铰链方向、按钮位置、音箱始终只有一个、桌面接触、提示音时间和最终标签可见度。

常见失败: 三个产品视角变成三个音箱。修正: 明确所有产品图片描述的是同一个实物,并要求每一帧始终只有一个音箱。

示例 2:从 10 秒源视频得到 15 秒结果

简报: 把一段成功的运动员落地镜头继续延长 5 秒。

素材: 一个符合条件的 10 秒源视频;除非面孔已经漂移,否则不添加人物身份参考图。

流程: 选择 Extend Video,增加 5 秒,重新描述最后姿势和镜头状态,再写起身与最终看向镜头的动作。不要重写原始 10 秒。

审核: 始终是同一名运动员,不重复落地,接缝处姿势匹配,场馆几何稳定,镜头运动连续,环境声不变。

常见失败: 延长片段一开始,运动员已经站起来。修正: 要求延长首帧先延续下蹲落地姿势,之后才能开始新动作。

示例 3:多场景 180 秒品牌短片

简报: 跟随一名设计师,观察他在工作室、街道、列车和户外地点测试一个原型。

素材: 人物档案、服装视图、原型多角度图、四个地点参考、最难动作的运动视频、声音样本和故事板锚点。

流程: 建立场景卡,锁定原型的归属者和状态,定义音频转场,先生成最难的场景,再用相同形状或动作连接各场景。

审核: 面孔、服装、原型几何、道具状态、时间变化、运动方向、音色一致性、BGM 连续性和每个场景边界。

常见失败: 从第二个地点开始,服装或产品细节漂移。修正: 在每张场景卡中重复人物与道具档案,并减少包含冲突人物或产品的场景参考。

导出前质量检查清单

人物与物体

  • 每个人都保持指定的面孔、发型、服装、声音和位置。
  • 物体数量、归属者、几何结构、标签和状态保持一致。
  • 参考素材中的人物、logo、字幕或道具没有意外进入结果。

时间与故事

  • 每个节拍都按预期顺序发生。
  • 每个时间范围都达到一个可见的结束状态。
  • 对白、音效和音乐支持动作,而不是与动作争夺注意力。
  • 最后一帧满足制作简报。

镜头与空间

  • 镜头轴线、高度、方向和运动始终符合设计。
  • 比例、地平线、接触、阴影、反射和遮挡关系合理。
  • 延长和转场处没有明显的姿势、光线或音频跳变。

编辑与清理

  • 只有目标对象发生改变。
  • 编辑边界没有闪烁或漂移。
  • 删除文字或物体后,露出的背景合理。
  • 清除 BGM 时保留了简报要求的对白、音效和环境声。

Seedance 2.5 常见问题排查

症状可能原因实用修正
时间戳被忽略一个时间范围内塞入过多竞争动作减少事件,并给该范围一个结束状态
重要动作缺失时间线过载拆分动作,或移动到另一个阶段
人物身份互换没有逐人映射参考素材创建命名档案,并禁止面孔、服装、声音和位置互换
参考素材相互冲突多个素材控制同一属性添加明确优先级和排除项
延长开头出现跳变缺少边界姿势或镜头状态先重述源视频最后一帧,再写新动作
透视编辑让主体变形空间层次和受保护几何不明确定义前景、中景、背景、比例、地平线和接地关系
删除物体后有残影没有说明隐藏背景和遮挡描述整个时间范围内需要重建的内容
字幕区域闪烁只用一帧判断清理效果检查运动过程,并要求连续重建纹理
删除 BGM 时损伤对白不同音频层被归为一类分别列出对白、音效、环境声和音乐
绿幕边缘闪动细小边缘和运动模糊未受保护锁定头发、手指、透明材质、模糊和人物轮廓
故事板转场突兀画格只定义状态,没有连接动作在每对画格之间写转场句
长视频场景漂移全局连续性规则没有重复在每张场景卡中重复人物、道具、地点和音频档案

在产品工作流中复用这套方法

Dreamina 适合手动创作和编辑。做软件自动化时,reAPI 上的 Seedance 2.5目前还不能调用;Seedance 2.0是当前可用于生产的选择。把模型名称设为可配置项,把本文的提示词和通过条件保存成评估集;将来经过验证的 2.5 端点开放后,仍可以复用同一套连续性检查。

常见问题

30 秒提示词应该放多少动作?

围绕一个主要事件安排大约 3–5 个节拍,每个节拍都有一个可观察的结束状态。如果某个动作反复被遗漏,先减少事件数量,不要继续加形容词。

怎样延长场景而不出现明显跳变?

开头先重述源视频最后一帧的人物姿势、画面位置、运动方向、镜头状态、光线和音频。锁定边界后,再描述新动作。

任何源视频都能延长吗?

官方 Dreamina 指南要求,用于所述 Extend Video 工作流的原始源视频必须短于 30 秒。[1]

应该用满全部 50 个参考素材槽位吗?

通常不需要。使用能够定义身份、服装、道具、场景、动作和声音的最小素材包。每增加一个素材,就多出一组需要映射和保持的关系。

Smart Edit 和 Edit with Marks 有什么区别?

Smart Edit 更适合结果层面的修正;当你能指出一个明确物体或有边界的区域时,Edit with Marks 更合适。两种方式都要列出必须保持不变的内容。

怎样防止两位说话者互换身份或声音?

为每个人建立命名档案,分别绑定面孔、服装和音频参考;每句对白点名说话者;其中一人行动时,明确另一人保持不动。

可以删除 BGM,同时保留对白和音效吗?

把对白、音效、环境声和音乐当作四个独立音轨。要求删除 BGM,并明确保留其余三层,然后检查人声损伤和音量跳变。

Clay Renderer 应该控制什么?

用它控制预演:几何、镜头路径、动作、接触和遮挡。人物身份、服装、材质、环境和最终风格应交给其他参考素材。

故事板为什么仍需要转场指令?

画格定义锚点状态,不会定义所有中间运动。转场句负责说明位置、速度、镜头、光线和道具如何从一个锚点移动到下一个锚点。

先完成镜头,再保护已经成功的部分

当每个工作流只承担一个明确职责时,Seedance 2.5 会更容易导演。为每个时间段写明结束状态,从记录清楚的边界延长视频,用场景卡组织长项目,为每个参考素材指定职责,并先写明不能改变的内容,再做局部编辑。

最有用的习惯也最简单:每次生成或编辑前,都写下修改、保持、验收。这样才能把功能清单真正变成可重复的制作流程。

参考资料

  1. ByteDance Dreamina。Dreamina Seedance 2.5 用户指南。 2026 年 7 月 31 日修改,2026 年 8 月 2 日检索自 bytedance.larkoffice.com
  2. ByteDance Dreamina。Dreamina Seedance 2.5 提示词指南。 2026 年 7 月 31 日修改,2026 年 8 月 2 日检索自 bytedance.larkoffice.com

延伸阅读

作者

avatar for reAPI Team
reAPI Team

分类

TL;DR:先选工作流,再写提示词Seedance 2.5 工作流一览新手和专业创作者怎样使用本指南新手示例:先做一个清楚的 8 秒镜头进阶版本:在同一个镜头上增加控制按任务查找对应示例生成前:先写一页制作简报建立连续性表创建素材清单生成前先定义通过条件在 Dreamina 中启动项目在 30 秒、视频延长和 Ultra Long Video 之间选择在 30 秒内完成一个完整场景延长现有视频,同时避免明显跳变规划最长 180 秒的 Ultra Long Video 项目使用多模态参考,但别让它们互相打架为冲突参考设置优先顺序让首帧和尾帧保持兼容用三种时间指令导演时间线建立四轨节拍表选择正确的编辑工作流Smart Edit:描述结果和边界Edit with Marks:控制一个物体或区域Edit Video:让源视频成为主素材移除字幕、BGM 和不需要的视觉元素删除无关字幕,同时保留有用文字分离或移除 BGM,同时保护人声跨时间删除一个物体转移创意,同时排除不需要的细节改变空间视角,同时保持几何关系控制音色参考和多人场景用绿幕编辑获得更干净的合成使用 Clay Renderer 指导动作和空间预演制作无缝转场和多宫格故事板三个端到端工作流示例示例 1:30 秒产品故事示例 2:从 10 秒源视频得到 15 秒结果示例 3:多场景 180 秒品牌短片导出前质量检查清单人物与物体时间与故事镜头与空间编辑与清理Seedance 2.5 常见问题排查在产品工作流中复用这套方法常见问题30 秒提示词应该放多少动作?怎样延长场景而不出现明显跳变?任何源视频都能延长吗?应该用满全部 50 个参考素材槽位吗?Smart Edit 和 Edit with Marks 有什么区别?怎样防止两位说话者互换身份或声音?可以删除 BGM,同时保留对白和音效吗?Clay Renderer 应该控制什么?故事板为什么仍需要转场指令?先完成镜头,再保护已经成功的部分参考资料延伸阅读