GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Opus 5.5 视频生成:指导 Seedance 2.5 镜头
2026/09/29

Opus 5.5 视频生成:指导 Seedance 2.5 镜头

Opus 5.5 视频生成正确做法:Claude 写计划,GPT Image 2.5 锁定角色,Seedance 2.5 渲染。包含提示、代码和实际成本。

Opus 5.5 视频生成现在出现在 YouTube 和 Brave 自动完成中,但这个短语掩盖了一个误解。Claude Opus 5.5 不会渲染视频。它是通过聊天端点提供的语言模型,具有 1M 令牌上下文窗口[1]。它的异常之处在于大多数 AI 视频做错的部分:决定谁在镜头中、摄像机坐在哪里、逐秒发生什么以及音频应该是什么。

最清晰的公开例子是 r/Seedance_AI 上的 9 月 24 日分析。作者说他们"没有手动编写单个提示":Opus 5.5 将一个概念和几张样式截图转换为角色表、开始帧、摄像机运动、对话时序和声音,像素来自 GPT Image 2.5 和 Seedance 2.5[2]。本指南将该管道分解,针对供应商自己的文档检查每一步,并展示如何从一个 API 密钥运行所有三个模型。

快速总结

  • Opus 5.5 做计划,不做渲染。 在这个工作流中,它写每个提示;GPT Image 2.5 绘制静止画面,Seedance 2.5 生成动画镜头[2]。
  • 描述摄像机操作员,不是"逼真"。 分析的关键技巧是告诉模型谁持有摄像机、他们坐在哪里,这会产生手摇、自动对焦寻找、曝光偏移[2]。
  • GPT Image 2.5 是身份锚。 OpenAI 说它"更善于保留参考照片中的主体"[3],这正是角色表所需的。
  • Seedance 2.5 需要结构。 ByteDance 的指南要求编号的资源绑定(Image 1、Image 2)、无缝时间戳、显式负面控制,如"无字幕"[4]。
  • 成本由视频秒数主导。 reAPI 上的两个 10 秒 1080p Seedance 2.5 镜头成本 $9.24;两张静止图像和 Opus 5.5 规划运行总共不到一美元[5][6][7]。

Opus 5.5 视频生成为何从脚本开始

视频模型奖励具体性并惩罚模糊性。ByteDance 在 Seedance 2.5 指南中直接说明:提示编写"主要影响指令遵循、材料一致性和生成可控性",并且不会改变模型的基本限制[4]。同一指南警告说,时间范围内的情节太少会让模型即兴发挥,太多会导致过度的剪切或掉失的节拍[4]。

这是一个写作问题,也是强大的语言模型赚取成本的地方。Reddit 分析中的单个 Seedance 2.5 镜头超过 1200 个单词:参考块、摄像机锁定、四个定时节拍(带对话和情感线索)、电影外观部分、音频部分和否定列表[2]。手工保持所有这些在多个镜头中的一致性很乏味。要求 Opus 5.5 在上下文中保留角色圣经并发出每个提示则不会。

Anthropic 自己对 Opus 5.5 的宣传正是这种纪律。它说该模型"将最重要的信息放在前面"并"遵循你给出的写作规则"[8]。对于提示生成,每次遵循模板比风格更重要。

分析中的一位评论者称其为使用语言模型做视频模型的工作。另一位回答了实际问题:"这些提示很庞大,很难在脑子里把所有东西都记住并在每个提示中正确格式化"[2]。同一评论者指出了这种方法的成本:Claude 在请求更正时倾向于添加"一堆垃圾",所以编辑模板,不是输出。

四阶段管道,逐步分析

阶段模型输入输出
1. 导演Claude Opus 5.5一个概念、样式截图、你的提示模板角色圣经、图像提示、定时视频提示
2. 角色表GPT Image 2.5主体照片 + 样式参考 + 表格提示一张 16:9 表格:转身、五种表情、细节面板
3. 开始帧GPT Image 2.5角色表 + 场景提示镜头的精确第一帧
4. 镜头Seedance 2.5角色表 + 开始帧 + 定时提示10 秒的剪辑,含对话和环境音

分析的角色表提示是一个很好的复制模板。它要求六角转身行和五种表情加细节面板,并声明"身份被锁定,面板间无漂移",同时将样式图像标记为"仅样式"[2]。这种区分很重要:没有标记的样式参考可能会将其人员泄漏到你的角色中。

开始帧是外观被烘烤的地方。作者将 2000 年代初期的点拍胶片渐变放入图像提示本身,而不是后期过滤:"35mm 胶片、略有桶形畸变的 28mm 广角镜头"、"提升黑色"、"清晰可见的胶片颗粒"[2]。Seedance 2.5 随后将该帧作为位置、灯光和渐变的主参考。

对于阶段 2 和 3,GPT Image 2.5 有两个版本。OpenAI 将 Flare 定位为"大多数应用的默认选择",将 Sunburst 定位为"从编辑中更紧密控制中受益的高级视觉工作流"[3]。你将为每张镜头重复使用的角色表是在 Sunburst 上花费额外每张图像 $0.002 的合理位置。

摄像机操作员技巧,以及 Seedance 指南添加的内容

评论者指出的详细信息是作者的第二点:不要要求"逼真视频"。说谁拿着摄像机、他们在哪里坐着、他们如何移动[2]。作者报告说,一句话"我的朋友从后座拍摄"足以让 Opus 5.5 在提示中写入微晃、延迟帧定位、自动对焦寻找和曝光偏移。

这是因为 Seedance 2.5 理解纯文本摄像机语言。ByteDance 列出了景别、"推近"、"环绕"和"手持摇晃"等运动、"第一人称视角"等角度,以及单长镜头等技术,作为你可以直接编写的术语[4]。一个有位置和身体的摄像机操作员给了模型一致使用它们的理由。

Opus 5.5 模板中应包括来自官方指南的五个额外规则:

  1. 对每个资源进行编号和绑定。 按上传顺序将上传指为 Image 1、Image 2,并在文本中声明每个绑定。ByteDance 建议不要依赖图像内绘制的标签[4]。
  2. 保持时间戳连续。 写"0-3 秒... 3-7 秒...",避免间隙;不要对快速重复动作(如"每秒摇头三次")使用时间戳[4]。
  3. 说出你在音频中不想要的。 "无 BGM;仅生成环境音和动作音"和"无字幕"都是支持的否定[4]。
  4. 用双引号放置音声行。 reAPI 的 Seedance 2.5 参考指出,引用的行可以引导生成的语音[9]。
  5. 按时间范围预算情节。 每个阶段应保持一个明确的事件和结束状态[4]。

ByteDance 还发布了官方的 Seedance 2.5 提示优化技能。其指南建议使用 npx --yes skills@latest add "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" --skill sd25-pe --yes 安装它,然后在 AI 聊天框中先输入 /sd25-pe,后面接上你的提示词[4]。Opus 5.5 可以起草镜头,技能可以根据 ByteDance 自己的约定检查它。

Opus 5.5 的导演提示

每个 Opus 5.5 视频生成运行从同一指令块开始。这是一个起始模板,不是那位 Reddit 作者会话的原文记录。替换括号部分。

You are the director and prompt writer for a short live-action AI video.
Concept: [one paragraph]
Style references: Image 2 and Image 3 are STYLE ONLY (grade, lens, grain).
Subject: Image 1 is the person. Identity must never drift.
Camera operator: [who films, where they sit, what device, how they move].

Produce, in order:
1. A character bible: face, hair, wardrobe, jewelry, props. Fixed wording.
2. A GPT Image 2.5 prompt for a 16:9 character sheet (turnaround,
   five expressions, detail panels, "Identity is locked").
3. A GPT Image 2.5 prompt for the start frame of shot 1.
4. A Seedance 2.5 prompt per shot, 10 seconds each, with:
   - Asset bindings: "Image 1 = identity, Image 2 = start frame"
   - A camera section written from the operator's point of view
   - Continuous timestamps (0-3s, 3-5s, 5-8.5s, 8.5-10s), one event each
   - Dialogue in double quotes, with emotion cues per phrase
   - Audio: on-camera mic only, list ambient sounds, "No BGM" if needed
   - Negatives: "No subtitles", no cuts unless requested, no morphing
Reuse the character bible wording verbatim in every prompt.

最后一行是停止漂移的。如果每个提示以略微不同的方式描述项链,视频模型也会这样做。

从一个键运行 Opus 5.5、GPT Image 2.5 和 Seedance 2.5

所有三个模型都在同一 reAPI 键后面。Opus 5.5 使用模型 ID claude-opus-5-5 通过聊天完成端点[1]。GPT Image 2.5 和 Seedance 2.5 是异步的:你提交、收到任务 ID,并轮询 GET /api/v1/tasks/{id} 直到状态为 completed[9][10]。

import time, requests

BASE = "https://reapi.ai/api/v1"
H = {"Authorization": "Bearer YOUR_API_KEY"}

def wait(task_id):
    while True:
        t = requests.get(f"{BASE}/tasks/{task_id}", headers=H).json()
        if t["status"] in ("completed", "failed"):
            return t
        time.sleep(10)

# 1. Opus 5.5 writes the prompts (DIRECTOR_PROMPT = the template above)
plan = requests.post(f"{BASE}/chat/completions", headers=H, json={
    "model": "claude-opus-5-5",
    "messages": [{"role": "user", "content": DIRECTOR_PROMPT}],
    "reasoning_effort": "high",
    "max_tokens": 16000,
}).json()["choices"][0]["message"]["content"]
# parse SHEET_PROMPT, FRAME_PROMPT, SHOT_PROMPT out of `plan`

# 2. Character sheet from the subject photo and style references
sheet = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": SHEET_PROMPT,
    "image_urls": [SUBJECT_URL, STYLE_URL_1, STYLE_URL_2],
}).json()["id"])["output"]["image_urls"][0]

# 3. Start frame, anchored to the sheet
frame = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": FRAME_PROMPT,
    "image_urls": [sheet],
}).json()["id"])["output"]["image_urls"][0]

# 4. The 10-second shot. Image 1 = sheet, Image 2 = start frame
shot = wait(requests.post(f"{BASE}/videos/generations", headers=H, json={
    "model": "doubao-seedance-2.5-face",
    "prompt": SHOT_PROMPT,
    "image_urls": [sheet, frame],
    "duration": 10,
    "resolution": "1080p",
    "size": "16:9",
}).json()["id"])["output"]["video_urls"][0]
print(shot)

参考文档中的三个细节值得在运行前了解。每个媒体字段必须是公开的 HTTP(S) URL;base64 和 data: URI 被拒绝[9]。Seedance 2.5 接受最多 30 个参考图像,所以表格、开始帧和几张道具照片都能轻松容纳[9]。Opus 5.5 始终适应性思考;reasoning_effort 改变其深度,原生默认值是中等[1]。

一个 Opus 5.5 视频生成运行的成本

下面的价格是 reAPI 在 2026 年 9 月 29 日公布的费率[5][6][7]。Opus 5.5 行假设一个包含 30,000 个输入令牌和 10,000 个输出令牌的规划会话。该数字是示意,不是测量值;你的模板长度和工作量会改变它。

项目费率数量成本
Opus 5.5 输入每百万令牌 $3.2030,000$0.096
Opus 5.5 输出每百万令牌 $16.0010,000$0.160
GPT Image 2.5 Sunburst每张图像 $0.0252$0.05
Seedance 2.5, 1080p每秒 $0.46220 秒$9.24
合计约 $9.55

视频秒数占账单的 96% 以上。重要的杠杆都在 Seedance 侧:720p 以每秒 $0.267 运行(相同 20 秒为 $5.34),Seedance 2.5 Eco 级别以相同请求体每秒 $0.347 计费 1080p[7][9]。明智的方法是在 720p 迭代直到性能和摄像机正确,然后以 1080p 渲染保留版本。

比较中,Anthropic 列出 Opus 5.5 为每百万令牌 $4 输入和 $20 输出,并说它在典型工作负载上比 Opus 5 成本低约 40%[8]。无论如何,导演是便宜的部分。

FAQ

Claude Opus 5.5 可以自己生成视频吗?

不行。Opus 5.5 是通过聊天完成调用的语言模型;它返回文本[1]。在 Opus 5.5 视频生成工作流中,它编写提示,Seedance 2.5 等视频模型渲染剪辑。

Seedance 2.5 技能是什么?

这是 ByteDance 的官方 Seedance 2.5 提示优化技能,名称为 sd25-pe。BytePlus 指南用 npx skills 安装它,调用方式是在 AI 聊天框中输入 /sd25-pe,后面接上你的提示词[4]。

Seedance 2.5 视频可以多长?

每个生成最多 30 秒。在 reAPI 上,duration 接受 4 到 30 秒,或 -1 让模型选择[9]。Reddit 工作流使用 10 秒镜头并将它们编辑在一起[2]。

Opus 5.5 和 Seedance 2.5 剪辑要花多少钱?

使用上面假设的令牌计数,两个 10 秒 1080p 镜头、两个 GPT Image 2.5 Sunburst 静止图像和一个规划会话的约 $9.55。在 720p 以相同运行大约 $5.65 渲染[5][6][7]。

我应该为角色表使用 GPT Image 2.5 Flare 还是 Sunburst?

如果表格将固定多个镜头,则使用 Sunburst。OpenAI 将其描述为提供"编辑中更紧密控制";Flare 是更快的默认值[3]。在 reAPI 上,差异是每张图像 $0.023 对 $0.025[6]。

这个工作流需要 Claude Code 吗?

不需要。上面的脚本通过纯 HTTP 调用 Opus 5.5。Anthropic 在 Claude Code 中提供 Opus 5.5,包括快速模式[8],这是迭代模板或运行 /sd25-pe 技能的舒适场所。生产管道只需要一个 API 密钥。

Opus 5.5 可以计划音乐视频吗?

它可以编写镜头列表、时序和音频方向。Seedance 2.5 生成视频、语音、音效和背景音乐,它也接受参考音频(最多 10 个轨道、总共 30 秒),所以歌曲可以驱动编辑[9]。

将 Opus 5.5 视为导演,Seedance 2.5 视为工作人员

在 r/Seedance_AI 周围进行的工作流成功是出于平凡的原因:每个提示都很长、具体且一致,语言模型优于疲惫的人类。给 Opus 5.5 一个固定模板、一个它必须逐字重复使用的角色圣经,以及一个有座位和设备的摄像机操作员。让 GPT Image 2.5 锁定脸部,在最终 1080p 渲染之前将迭代预算花在 720p Seedance 2.5 秒上。这是实际发货的 Opus 5.5 视频生成:一个模型思考,两个渲染,一个 API 密钥处理 reAPI 的所有内容。

参考资料

  1. reAPI. Claude Opus 5.5 API: model ID, parameters and pricing. Retrieved September 2026 from reapi.ai/docs/claude-opus-5-5
  2. r/Seedance_AI. Full Breakdown: How I used Claude Opus & Seedance 2.5 to achieve photorealistic AI videos (All Prompts Included). Posted September 24, 2026. Retrieved September 2026 from reddit.com/r/Seedance_AI/comments/1wop0ju
  3. OpenAI. Introducing ChatGPT Images 2.5. September 8, 2026. Retrieved September 2026 from openai.com/index/introducing-chatgpt-images-2-5
  4. BytePlus ModelArk. Dreamina Seedance 2.5 prompt guide. Retrieved September 2026 from docs.byteplus.com/en/docs/modelark/seedance-2-5-prompt-guide
  5. reAPI. Claude Opus 5.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/claude-opus-5-5
  6. reAPI. GPT Image 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/gpt-image-2-5
  7. reAPI. Seedance 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/seedance-2-5
  8. Anthropic. Introducing Claude Opus 5.5. Retrieved September 2026 from anthropic.com/claude-opus-5-5
  9. reAPI. Seedance 2.5 API: parameters, modes and billing. Retrieved September 2026 from reapi.ai/docs/seedance-2-5
  10. reAPI. GPT Image 2.5 API reference. Retrieved September 2026 from reapi.ai/docs/gpt-image-2-5