Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
GPT Image 2 加 Seedance 2.0:打造角色一致性工作流
2026/08/02

GPT Image 2 加 Seedance 2.0:打造角色一致性工作流

用 GPT Image 2 设计和冻结角色形象,用 Seedance 2.0 驱动动画,通过标准化检查点减少跨镜头角色漂移。

最可靠的 GPT Image 2 + Seedance 2.0 工作流将身份设计与动画分离。 先在 GPT Image 2 中设计和审批角色,然后重复使用同一套视觉资产生成每个镜头的起始帧,最后让 Seedance 2.0 动画化这个帧,而不是从文本重新创造人物。

这样可以减少角色漂移,因为每个模型只做一件事。GPT Image 2 控制脸部、轮廓、服装和构图。Seedance 2.0 控制动作、镜头、节奏和音频。这不能保证角色"绝不漂移"——当前没有 API 暴露完美的身份锁定——但它是一套可重复的制作工作流,带有清晰的检查点。

快速摘要

  • 先锁定静态帧再生成动作。 虚弱或不一致的起始帧会导致视频质量下降。
  • 创建一套规范的角色资产包。 保存中立肖像、全身视图、三四分之三视角和简短的身份描述文本。
  • 从这些冻结的参考生成每个镜头帧。 reAPI 上的 GPT Image 2 在单个图像转图像请求中接受最多 16 个公网图像 URL。
  • 提示 Seedance 描述动作,不描述身份。 传入审批过的帧,并描述动作、镜头、节奏和音效。
  • 重复使用参考而不在项目中途交换。 项目中途出现的"更好的"新脸孔会创建第二个角色定义。
  • 用返回的最后一帧链接镜头。 Seedance 2.0 可以返回最后帧,用于下一段,减少接缝处的视觉跳跃。

为什么 AI 视频镜头间的角色会漂移

文本描述不是身份记录。"一个短黑发、绿眼睛、穿红夹克的女性"描述了一个包含数百万种可能脸孔的类别。每个新的文字转视频请求可以抽样出另一个有效的人物,同时仍然遵循文字描述。

角色漂移也会通过看起来对人工审阅者无害的变化进入:

  • 不同的裁剪会隐藏下颌线或身体比例;
  • 戏剧性的光线变化会改变明显的眼睛、头发和肤色;
  • 服装提示与面部细节竞争;
  • 新参考引入了不同的鼻子、年龄或发型;
  • 动作指令要求源帧无法支持的转动或遮挡。

Seedance 2.0 接受文本、图像、音频和视频作为参考模态,在其当前开放平台上最多支持九张图像、三个视频和三个音频剪辑。[2] 更多参考不会自动意味着更多一致性。只有在它们相符时才有效。

两阶段角色一致性工作流

GPT Image 2 身份设计流向 Seedance 2.0 动作和连续性检查

该流程有六个关卡。在当前关卡通过前不要前进,因为动画后修复身份比重新生成静态帧要慢。

1. 撰写身份契约

仅定义每个镜头中必须存在的特征。保持文本块足够简短,以便原样粘贴到图像提示中。

CHARACTER: Mara, fictional adult woman, early 30s
FACE: oval face, wide-set brown eyes, straight nose, small scar above left eyebrow
HAIR: chin-length black bob, center part
WARDROBE: burnt-orange field jacket, charcoal crew-neck shirt
ANCHOR: narrow silver compass pendant
DO NOT CHANGE: age, facial geometry, hair length, scar side, pendant shape

避免使用"美丽"、"酷"或"电影感"等主观标签。它们会邀请模型重新设计人物。物理锚点更容易审计。

2. 在 GPT Image 2 中生成主肖像

从均匀的光线、中性表情、可见的面部几何和简单背景开始。GPT Image 2 支持图像生成和编辑;OpenAI 文档中文本作为输入,图像既作为输入又作为输出。[1]

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Character reference portrait. Fictional adult woman, early 30s, oval face, wide-set brown eyes, straight nose, small scar above left eyebrow, chin-length black bob with center part, neutral expression, even soft light, plain warm-gray background, realistic editorial photography, no text",
    "size": "3:4",
    "resolution": "2k"
  }'

将返回的 URL 保存为规范肖像。不要选择戏剧性的英雄图像作为主图;选择最容易识别的脸。

3. 将一个肖像扩展为参考包

使用图像转图像请求,在 image_urls 中包含批准的肖像。生成全身中立姿态、左右三四分之三视角和服装表。要求模型保留身份,而不是"创建相似的人物"。

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Preserve the exact identity, age, facial geometry, scar position, hair cut, jacket, shirt, and compass pendant from the reference. Create a clean full-body character sheet with front and three-quarter views, neutral stance, even studio light, plain background, no labels, no extra people",
    "image_urls": ["https://your-cdn.com/mara-master.png"],
    "size": "16:9",
    "resolution": "2k"
  }'

经济实惠的 gpt-image-2 路由每个请求返回一张图像,并接受最多 16 个公网 HTTP(S) 参考 URL。它不暴露种子或持久角色 ID。[3] 一致性因此来自重复提供相同的批准像素。

4. 为每个镜头创建受控的起始帧

在生成更多图像之前写出镜头列表。对于每个镜头,将主肖像和角色表反馈到 GPT Image 2,然后仅改变场景、姿态、镜头和构图。

Preserve the exact identity and wardrobe from Image 1 and Image 2.
Medium-wide 16:9 frame. Mara stands beside a rain-streaked train window at
night, body at three-quarter angle, face fully visible, compass pendant visible.
Camera at eye level, 50mm lens, soft carriage practical light.
No additional people. Do not change facial geometry, age, hairstyle, scar side,
jacket color, or pendant.

在付款动画之前根据主图审批静态。这是拒绝变化的脸、缺失的锚点或不兼容姿态的最便宜的地方。

5. 用 Seedance 2.0 驱动动画

先传入批准的镜头帧,然后根据需要跟随一个或两个规范的身份参考。当存在 image_urls 时,Seedance 选择图像转视频模式;reAPI 上没有单独的 mode 字段。[4]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.0-face",
    "prompt": "@Image1 remains the same character. She turns slowly toward the rain-streaked window and exhales. Subtle blink, natural breathing, gentle train vibration. Slow 10% camera push-in. Preserve face, black bob, eyebrow scar, orange jacket, and silver compass pendant. No scene cut, no wardrobe change.",
    "image_urls": [
      "https://your-cdn.com/shot-01-start.png",
      "https://your-cdn.com/mara-master.png"
    ],
    "size": "16:9",
    "resolution": "720p",
    "duration": 5,
    "generate_audio": true,
    "return_last_frame": true
  }'

对可识别的真人素材使用 Face 变体。合成角色可以使用符合条件的非 Face 或官方路由,但模型可用性和安全规则仍然适用。仅上传你有权利和同意使用的肖像。

6. 审看、拒绝和链接

逐帧检查完成的剪辑。检查开头、中间和末尾的脸,而不仅仅是缩略图。

检查通过条件失败时
面部几何眼睛、鼻子、下颌和年龄保持稳定从相同的批准起始帧重新生成
头发轮廓长度和分裂线保持可识别减少头转或风运动
身份锚点疤痕、吊坠和夹克保持存在缩短提示并重述不变量
手和遮挡长时间遮挡后脸未重建减少遮挡或分割动作
最后帧干净到足以开始下一个镜头链接前请求另一次尝试

当剪辑通过时,使用 output.last_frame_url 作为下一个 Seedance 请求的第一张图像。在其余参考槽中保留规范肖像。最后帧保护空间连续性;主肖像保护身份。

减少角色漂移的提示规则

指令的顺序很重要。有用的 Seedance 动作提示遵循这个顺序:

identity binding → action → camera → environment motion → audio → invariants

例如:

@Image1 remains the same character. She takes two measured steps toward the
door and looks over her left shoulder. Handheld camera tracks backward at chest
height. Curtains move slightly in the draft; quiet room tone and footsteps.
Preserve face, age, black bob, eyebrow scar, orange jacket, and pendant. No cut,
no new person, no costume change, no extreme motion blur.

不要重复与所提供的帧冲突的长视觉描述。帧已经定义了场景。提示应该将大部分标记花费在随时间变化上。

不该做什么

五个常见的快捷方式会使漂移恶化。

  1. 不要从文本生成每个镜头。 每个请求都会抽样一个新人物。
  2. 不要在第三个镜头后替换主图。 修复坏镜头,而不是规范身份。
  3. 不要混合来自不同代代的参考。 脸或服装中的细微差异会变成竞争指令。
  4. 不要立即要求极端动作。 在翻转、旋转、人群和重度遮挡之前测试眨眼、小转向或短走。
  5. 不要仅将漂移的最后帧作为唯一的下一参考。 将其与干净的主图配对或重新生成过渡。

Seedance 2.0 角色一致性指南更详细地涵盖了参考排序、语音重用、多镜头提示和更长的链。

成本和迭代策略

当失败在静态图像阶段被捕获时,这个工作流花费更少。一个 GPT Image 2 请求产生一个候选,而 Seedance 按输出时长和分辨率计费视频。上传的参考视频也可以添加可计费秒数;图像参考不会。[3][4]

一个有纪律的制作循环是:

  1. 生成低计数的 1K 或 2K 角色草稿。
  2. 审批一个主图并停止探索身份。
  3. 生成并审看每个起始帧作为静态。
  4. 用简单的动作动画化五秒的 720p 测试。
  5. 仅在提示通过后增加时长或分辨率。

当前费率会变化,因此从实时 GPT Image 2 模型页面Seedance 2.0 模型页面 计算预算,而不是将旧的每张图像或每秒数字复制到生产电子表格中。Seedance 成本每秒指南 解释了计费维度。

可重用的文件夹结构

将角色一致性作为资产管理,而不是提示运气。

project/
  character/
    identity-contract.txt
    master-portrait.png
    character-sheet.png
    approved-refs.json
  shots/
    01-train-window/
      start-frame.png
      motion-prompt.txt
      output.mp4
      last-frame.png
    02-platform/
      start-frame.png
      motion-prompt.txt

版本化身份契约和参考 URL。如果艺术总监批准真实重新设计,创建角色包 v2 并重新生成所有依赖镜头,而不是混合版本。

常见问题

GPT Image 2 + Seedance 2.0 能保证零角色漂移吗?

不能。它通过将每个镜头锚定到批准的图像来减少漂移,但两个 API 都不暴露完美的持久角色锁定。动作、遮挡、冲突的参考和长剪辑仍然可以改变身份。

我应该使用多少个角色参考?

从批准的镜头帧加一个主肖像开始。仅在角色表贡献缺失的角度或全身信息时才添加。API 最大值不是目标。

GPT Image 2 主肖像应该是电影感的吗?

不应该。使用均匀的光线、中性表情、可见的脸和简单的背景。在身份被批准后,将电影般的灯光构建到每个镜头帧中。

对真人我应该使用哪个 Seedance 2.0 模型?

使用接受可识别真人输入的 Face 变体,并确认你有同意和使用权利。官方/非 Face 路由可能会拒绝这样的参考。[4]

我可以重用 Seedance 的最后帧用于下一个剪辑吗?

可以。设置 return_last_frame: true,然后将返回的 URL 传入下一个请求。保留原始主参考在其旁边,这样小错误不会在序列中复合。

我应该添加"无脸部漂移"等负提示吗?

简短的不变量可能有帮助,但参考质量和可实现的动作更重要。干净的起始帧加上小的、可见的动作比一长串负项更强大。

一句话说出角色一致的 AI 视频工作流

GPT Image 2 定义和阶段化角色;Seedance 2.0 驱动批准的帧的动画;人工审看关卡防止一个漂移的镜头污染下一个。这就是实际的 GPT Image 2 + Seedance 2.0 角色一致性工作流——不是完美身份的承诺,而是可以重复、测量和改进的受控流程。

对于更广泛的图像生成概览,阅读 如何使用 GPT Image 2。对于超越角色的 Seedance 参考,请查看 Seedance 2.0 API 文档

参考资料

  1. OpenAI. GPT Image 2 model documentation — image generation and editing, modalities, endpoints, and snapshots. Retrieved August 2, 2026. developers.openai.com/api/docs/models/gpt-image-2
  2. Team Seedance et al. Seedance 2.0: Advancing Video Generation for World Complexity. April 2026. arxiv.org/abs/2604.14148
  3. reAPI. GPT Image 2 API documentation — reference limits, resolutions, and async task behavior. Retrieved August 2, 2026. reapi.ai/docs/gpt-image-2
  4. reAPI. Seedance 2.0 API documentation — mode routing, reference limits, variants, last-frame return, and billing. Retrieved August 2, 2026. reapi.ai/docs/seedance-2-0
  5. Devenko AI. GPT Image 2.0 + Seedance 2.0: The Only Workflow Where Your Character Never Drifts. July 2026. devenkoai.medium.com