GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Opus 5.5 ビデオ生成:Seedance 2.5 ショットをディレクション
2026/09/29

Opus 5.5 ビデオ生成:Seedance 2.5 ショットをディレクション

Opus 5.5 ビデオ生成の実践:Claudeがショット計画を書き、GPT Image 2.5がキャラクターを固定、Seedance 2.5がレンダリング。プロンプト、コード、実コスト。

Opus 5.5 ビデオ生成は YouTube と Brave オートコンプリートに表示されるようになりましたが、このフレーズは誤解を隠しています。Claude Opus 5.5 はビデオをレンダリングしません。これは 1M トークン コンテキスト ウィンドウを備えたチャット エンドポイント経由で提供される言語モデルです[1]。その異常な強みは、ほとんどの AI クリップが間違う部分です:フレーム内に誰がいるか、カメラがどこに座っているか、何が秒ごとに起こるか、オーディオが何であるかを決めることです。

最も明確な公開例は、r/Seedance_AI での 9 月 24 日の分解です。著者は「単一のプロンプトを手動で作成しなかった」と述べています:Opus 5.5 は 1 つのコンセプトと数いくつかのスタイル スクリーンショットをキャラクター シート、開始フレーム、カメラ ムーブ、ダイアログ タイミング、サウンドに変え、ピクセルは GPT Image 2.5 と Seedance 2.5 から来ました[2]。このガイドはそのパイプラインを分解し、各ステップをベンダーの公式ドキュメンテーションに対して確認し、3 つのモデルすべてを 1 つの API キーから実行する方法を示します。

要点

  • Opus 5.5 はプラン作成しますが、レンダリングはしません。 このワークフローでは、すべてのプロンプトを書きます;GPT Image 2.5 がスティルを描き、Seedance 2.5 が動く、話す、ショットを作ります[2]。
  • 「リアリズム」ではなく、カメラ オペレーターについて説明してください。 分解の重要なトリックは、モデルにカメラを持つ人と座る場所を伝える方法で、これは手持ちゆれ、オートフォーカス ハント、露出シフトを生じます[2]。
  • GPT Image 2.5 は身元固定です。 OpenAI は「参照写真から被写体をより良く保持しています」と述べています[3]。これはキャラクター シートが必要とするものです。
  • Seedance 2.5 は構造が好きです。 ByteDance のガイドは、番号付きアセット バインディング(Image 1、Image 2)、隙間のないタイムスタンプ、「字幕なし」などの明示的な負の制御を求めています[4]。
  • コストはビデオ秒によって支配されます。 reAPI での 2 つの 10 秒 1080p Seedance 2.5 ショットは $9.24 かかります;2 つのスティルと Opus 5.5 計画実行を合わせて 1 ドル未満を追加します[5][6][7]。

Opus 5.5 ビデオ生成がスクリプトで始まる理由

ビデオ モデルは特異性を褒め、曖昧さを罰します。ByteDance は Seedance 2.5 ガイドでこれを直接述べています:プロンプト作成は「主に命令フォロー、材料一貫性、生成制御性を影響し、モデルの基本的な制限は変わりません」[4]。同じガイドは、時間範囲のプロットが少なすぎるとモデルを即興させるように警告し、多すぎるとエクセッシブカットまたはドロップビートが生じます[4]。

それは書き問題です、そしてそれは強い言語モデルがそのコストを稼ぐ場所です。Reddit の分解での単一の Seedance 2.5 ショットは 1,200 以上の単語を実行します:参照ブロック、カメラ ロック、4 つのタイミング ビート(ダイアログと感情キュー)、フィルム ルックセクション、オーディオセクション、ネガティブリスト[2]。複数のショット全体でそれをすべて一貫させることは手で退屈です。Opus 5.5 にキャラクター聖書をコンテキストに保有して各プロンプトを放出させることはしません。

Anthropic 自身の Opus 5.5 のピッチはまさにこの種の厳密さです。それはモデルが「最も重要な情報を前面に置き」「あなたが与えるライティング ルールに従う」と述べています[8]。プロンプト生成では、毎回テンプレートに従うことは雰囲気よりも重要です。

分解のコメンテーターの 1 人は、ビデオ モデルの仕事をするための言語モデルの使用を呼び出しました。別のもが実践的なポイントに答えました:「これらのプロンプトは巨大で、すべてをほかのプロンプトで保有して正しくフォーマットするのは困難です」[2]。同じコメンテーターがこのアプローチのコストを指摘しました:Claude は修正を求めるときに「多くのゴミ」を追加する傾向があるため、出力をではなくテンプレートを編集してください。

4 段階パイプライン、ステップバイステップ

ステージモデル入力出力
1. ディレクターClaude Opus 5.51 つのコンセプト、スタイル スクリーンショット、プロンプト テンプレートキャラクター聖書、イメージ プロンプト、タイミング ビデオ プロンプト
2. キャラクター シートGPT Image 2.5主体写真 + スタイル参考 + シート プロンプト1 つの 16:9 シート:回転、表現、詳細パネル
3. 開始フレームGPT Image 2.5キャラクター シート + シーン プロンプトショットの正確な最初のフレーム
4. ショットSeedance 2.5キャラクター シート + 開始フレーム + タイミング プロンプトダイアログと環境オーディオを備えた 10 秒クリップ

分解のキャラクター シート プロンプトはコピーする良いテンプレートです。6 角のターンアラウンド行と 5 つの表現プラス詳細パネルの行を求め、「身元はロック、パネル間のドリフトなし」と述べ、スタイル イメージを「STYLE ONLY」とマークしています[2]。その分割は重要です:ラベル付けされていないスタイル参照はその人をあなたのキャラクターにリークさせることができます。

開始フレームは外観がベイクされる場所です。著者は 2000 年代初頭のポイント アンド シュート グレードをイメージ プロンプト自体に入れました、ポスト フィルターではありません:「35mm フィルム、わずかなバレル歪みを持つ 28mm ワイド レンズ」、「リフトされたブラック」、「目に見える微粒子フィルム グレイン」[2]。Seedance 2.5 は、その後、そのフレームをロケーション、ライト、グレードのマスター参考として扱います。

ステージ 2 と 3 では、GPT Image 2.5 は 2 つのバージョンで来ます。OpenAI は Flare を「ほとんどのアプリケーションのデフォルト選択」と位置付け、Sunburst を「編集全体にきつい制御から利益を得るプレミアム ビジュアル ワークフロー」として位置付けています[3]。すべてのショットのために再利用するキャラクター シートは、Sunburst に画像あたり $0.002 の追加を使う合理的な場所です。

カメラ オペレーター トリック、およびリファレンス Seedance がガイドに追加するもの

コメンテーターが目立つ詳細は著者の 2 番目のポイントでした:「現実的なビデオ」を求めないでください。誰が カメラを持っているか、どこに 座っているか、どのように 動いているか言ってください[2]。著者は 1 行が「私の友人は後部座席から映画している」と言う Opus 5.5 にマイクロシェイク、遅延フレーミング、オートフォーカス ハント、露出シフトをプロンプトに書かせるのに十分だったと報告します。

これは Seedance 2.5 が プレーン カメラ言語を理解するためです。ByteDance は、「プッシュ イン」、「オービット」、「ハンドヘルド シェイク」などのムーブ、「一人称視点」などの角度、ワンショット ロング テイクなどのテクニックを直接書くことができる用語として、ショットサイズをリストします[4]。ロケーションと本体を持つカメラ オペレーターは、モデルに一貫してそれらを使う理由を与えます。

Opus 5.5 に手渡すテンプレートに属する公式ガイドからの 5 つの追加ルール:

  1. すべてのアセットを番号付けしてバインドします。 アップロードを Image 1、Image 2 をアップロード順序で参照し、テキストで各バインディングを述べてください。ByteDance は画像内に描かれたラベルへの依存に対して助言します[4]。
  2. タイムスタンプを連続キープします。 「0-3 秒... 3-7 秒...」を書き、隙間を避け、「1 秒あたり 3 回頭を振る」などの迅速な繰り返し動作のタイムスタンプを使用しないでください[4]。
  3. オーディオで望まないものを言ってください。 「BGM なし;環境音と操作音のみ生成」と「字幕なし」は両方とも対応されたネガティブです[4]。
  4. 二重引用符で音声行をプットしてください。 reAPI の Seedance 2.5 リファレンスは、引用された行が生成された音声をステアリングすることを指摘しています[9]。
  5. 時間範囲あたりのプロットを予算してください。 各ステージは 1 つの明確なイベントと終了状態を保有する必要があります[4]。

ByteDance はまた、公式の Seedance 2.5 プロンプト-最適化スキルを公開しています。そのガイドは npx --yes skills@latest add "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" --skill sd25-pe --yes でそれをインストールし、その後 AI チャット ボックスでプロンプトの後に /sd25-pe をタイプすることを推奨しています[4]。Opus 5.5 はショットを作成でき、スキルは ByteDance 自身の規則に対してそれを確認できます。

Opus 5.5 のディレクター プロンプト

すべての Opus 5.5 ビデオ生成実行は同じ命令ブロックから始まります。これは処方箋ではなく、起動テンプレートです。大括弧の部分を置き換えてください。

You are the director and prompt writer for a short live-action AI video.
Concept: [one paragraph]
Style references: Image 2 and Image 3 are STYLE ONLY (grade, lens, grain).
Subject: Image 1 is the person. Identity must never drift.
Camera operator: [who films, where they sit, what device, how they move].

Produce, in order:
1. A character bible: face, hair, wardrobe, jewelry, props. Fixed wording.
2. A GPT Image 2.5 prompt for a 16:9 character sheet (turnaround,
   five expressions, detail panels, "Identity is locked").
3. A GPT Image 2.5 prompt for the start frame of shot 1.
4. A Seedance 2.5 prompt per shot, 10 seconds each, with:
   - Asset bindings: "Image 1 = identity, Image 2 = start frame"
   - A camera section written from the operator's point of view
   - Continuous timestamps (0-3s, 3-5s, 5-8.5s, 8.5-10s), one event each
   - Dialogue in double quotes, with emotion cues per phrase
   - Audio: on-camera mic only, list ambient sounds, "No BGM" if needed
   - Negatives: "No subtitles", no cuts unless requested, no morphing
Reuse the character bible wording verbatim in every prompt.

最後の行はドリフトを停止するものです。ネックレスをわずかに異なるように説明する各プロンプトの場合、ビデオ モデルもそうします。

1 つのキーから Opus 5.5、GPT Image 2.5、Seedance 2.5 を実行する

3 つのモデルすべてが同じ reAPI キーの背後に座ります。Opus 5.5 はモデル ID claude-opus-5-5 を使用してチャット完成エンドポイントを使用します[1]。GPT Image 2.5 と Seedance 2.5 は非同期です:提出し、タスク ID を受け取り、GET /api/v1/tasks/{id} をステータス completed までポーリングします[9][10]。

import time, requests

BASE = "https://reapi.ai/api/v1"
H = {"Authorization": "Bearer YOUR_API_KEY"}

def wait(task_id):
    while True:
        t = requests.get(f"{BASE}/tasks/{task_id}", headers=H).json()
        if t["status"] in ("completed", "failed"):
            return t
        time.sleep(10)

# 1. Opus 5.5 writes the prompts (DIRECTOR_PROMPT = the template above)
plan = requests.post(f"{BASE}/chat/completions", headers=H, json={
    "model": "claude-opus-5-5",
    "messages": [{"role": "user", "content": DIRECTOR_PROMPT}],
    "reasoning_effort": "high",
    "max_tokens": 16000,
}).json()["choices"][0]["message"]["content"]
# parse SHEET_PROMPT, FRAME_PROMPT, SHOT_PROMPT out of `plan`

# 2. Character sheet from the subject photo and style references
sheet = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": SHEET_PROMPT,
    "image_urls": [SUBJECT_URL, STYLE_URL_1, STYLE_URL_2],
}).json()["id"])["output"]["image_urls"][0]

# 3. Start frame, anchored to the sheet
frame = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": FRAME_PROMPT,
    "image_urls": [sheet],
}).json()["id"])["output"]["image_urls"][0]

# 4. The 10-second shot. Image 1 = sheet, Image 2 = start frame
shot = wait(requests.post(f"{BASE}/videos/generations", headers=H, json={
    "model": "doubao-seedance-2.5-face",
    "prompt": SHOT_PROMPT,
    "image_urls": [sheet, frame],
    "duration": 10,
    "resolution": "1080p",
    "size": "16:9",
}).json()["id"])["output"]["video_urls"][0]
print(shot)

リファレンス ドキュメントからの 3 つの詳細は実行前に知る価値があります。すべてのメディア フィールドは public HTTP(S) URL である必要があります;base64 と data: URI は拒否されます[9]。Seedance 2.5 は 30 個までのリファレンス イメージを受け入れるため、シート、開始フレーム、いくつかの小道具ショットが簡単に適合します[9]。そして Opus 5.5 は常に適応的に考える;reasoning_effort がどのぐらい深いか変え、ネイティブデフォルトは中程度です[1]。

1 つの Opus 5.5 ビデオ生成実行がコストするもの

以下の価格は 2026 年 9 月 29 日にアメリカのリリース レート[5][6][7]。Opus 5.5 行は 30,000 の入力トークンと 10,000 の出力トークンの計画セッションを想定します。その図は図説ではなく測定値です;あなたのテンプレート長さと努力レベルはそれを動かします。

項目評価数量コスト
Opus 5.5 入力100 万トークンあたり $3.2030,000$0.096
Opus 5.5 出力100 万トークンあたり $16.0010,000$0.160
GPT Image 2.5 Sunburstイメージあたり $0.0252$0.05
Seedance 2.5、1080p秒あたり $0.46220 秒$9.24
合計約 $9.55

ビデオ秒は請求書の 96% 以上です。重要なレバーはすべて Seedance サイドにあります:720p は秒あたり $0.267 で実行します(同じ 20 秒で $5.34)、Seedance 2.5 Eco ティアは同じリクエスト本体で 1080p を秒あたり $0.347 で請求します[7][9]。合理的なルーチンは パフォーマンスとカメラが正しくなるまで 720p で反復し、その後キーパーを 1080p でレンダリングする方法です。

比較では、Anthropic は Opus 5.5 を 100 万トークンあたり $4 入力と $20 出力でリストし、一般的なワークロードでは Opus 5 より約 40% 安いコストと述べています[8]。どちらにしても、ディレクターは廉価な部分です。

FAQ

Claude Opus 5.5 はそれ自体でビデオを生成できますか?

いいえ。Opus 5.5 はチャット完成を通じて呼ばれる言語モデルです;それはテキストを返します[1]。Opus 5.5 ビデオ生成ワークフローでは、プロンプトを書き、Seedance 2.5 などのビデオ モデルがクリップをレンダリングします。

Seedance 2.5 スキルとは何ですか?

それは Seedance 2.5、sd25-pe という名前の ByteDance の公式プロンプト-最適化スキルです。BytePlus ガイドは npx skills でそれをインストールし、AI チャット ボックスでプロンプトの後に /sd25-pe をタイプして呼び出します[4]。

Seedance 2.5 ビデオはどのぐらい長いことができますか?

生成あたり最大 30 秒。reAPI では、duration は 4 から 30 秒、または -1 でモデルに選択させるを受け入れます[9]。Reddit ワークフローは 10 秒のショットを使用し、それらをまとめてカットしました[2]。

Opus 5.5 と Seedance 2.5 クリップはいくらかかりますか?

2 つの 10 秒 1080p ショット、2 つの GPT Image 2.5 Sunburst スティル、上記で想定されたトークン カウントでの 1 つの計画セッションの約 $9.55。720p でのレンダリングは同じ実行を約 $5.65 にもたらします[5][6][7]。

キャラクター シートに対して GPT Image 2.5 Flare または Sunburst を使用する必要がありますか?

Sunburst、シートが複数のショットを固定する場合。OpenAI は「編集全体にきつい制御」を提供するとして説明します;Flare はより速いデフォルトです[3]。reAPI では違いはイメージあたり $0.023 対 $0.025[6]。

このワークフローに対して Claude Code が必要ですか?

いいえ。上記のスクリプトはプレーン HTTP 経由で Opus 5.5 を呼び出します。Anthropic は Claude Code に Opus 5.5 を提供し、高速モードを含む[8]、そしてそれはテンプレートを反復するか /sd25-pe スキルを実行する快適な場所です。本番パイプラインは API キーのみを必要とします。

Opus 5.5 は音楽ビデオをプランできますか?

ショット リスト、タイミング、サウンド方向を書くことができます。Seedance 2.5 はクリップで音声、音響効果、背景音楽を生成し、参照オーディオ(最大 10 トラック、30 秒の合計)も受け入れるため、曲は編集をドライブできます[9]。

Opus 5.5 をディレクターとして、Seedance 2.5 をスタッフとして扱ってください

r/Seedance_AI の周りを行ったワークフローは、退屈な理由で成功します:すべてのプロンプトは長く、具体的で、一貫性があり、言語モデルは疲れた人間よりも良いです。固定テンプレート、再利用する必要があるキャラクター聖書、座席と装置を持つカメラ オペレーターを Opus 5.5 に与えてください。GPT Image 2.5 に顔をロックさせ、反復予算を最終 1080p レンダーの前に 720p Seedance 2.5 秒に費やしてください。これは実際に出荷する Opus 5.5 ビデオ生成です:1 つのモデルが考え、2 つがレンダリングし、1 つの API キーがすべてのメンタルで reAPI。

参照

  1. reAPI. Claude Opus 5.5 API: model ID, parameters and pricing. Retrieved September 2026 from reapi.ai/docs/claude-opus-5-5
  2. r/Seedance_AI. Full Breakdown: How I used Claude Opus & Seedance 2.5 to achieve photorealistic AI videos (All Prompts Included). Posted September 24, 2026. Retrieved September 2026 from reddit.com/r/Seedance_AI/comments/1wop0ju
  3. OpenAI. Introducing ChatGPT Images 2.5. September 8, 2026. Retrieved September 2026 from openai.com/index/introducing-chatgpt-images-2-5
  4. BytePlus ModelArk. Dreamina Seedance 2.5 prompt guide. Retrieved September 2026 from docs.byteplus.com/en/docs/modelark/seedance-2-5-prompt-guide
  5. reAPI. Claude Opus 5.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/claude-opus-5-5
  6. reAPI. GPT Image 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/gpt-image-2-5
  7. reAPI. Seedance 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/seedance-2-5
  8. Anthropic. Introducing Claude Opus 5.5. Retrieved September 2026 from anthropic.com/claude-opus-5-5
  9. reAPI. Seedance 2.5 API: parameters, modes and billing. Retrieved September 2026 from reapi.ai/docs/seedance-2-5
  10. reAPI. GPT Image 2.5 API reference. Retrieved September 2026 from reapi.ai/docs/gpt-image-2-5