GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone
Opus 5.5: режиссура видео для Seedance 2.5
2026/09/29

Opus 5.5: режиссура видео для Seedance 2.5

Генерация видео с Opus 5.5: Claude пишет план съёмки, GPT Image 2.5 фиксирует персонажа, Seedance 2.5 рендерит. Промпты, код и реальная стоимость.

Opus 5.5 видеогенерация сейчас появляется в подсказках YouTube и Brave, и фраза скрывает неправильное понимание. Claude Opus 5.5 не рендерит видео. Это языковая модель с контекстным окном на 1 млн токенов, обслуживаемая через чат-эндпоинт[1]. То, что она делает необычайно хорошо — это то, что большинство ИИ-клипов делают неправильно: решить, кто находится в кадре, где сидит камера, что происходит секунду за секундой, и какой должна быть звуковая дорожка.

Самый ясный общедоступный пример — разбор от 24 сентября на r/Seedance_AI. Автор сказал, что они "не написали ни одного промпта вручную": Opus 5.5 превратил одну концепцию и несколько скриншотов стиля в листы персонажей, стартовые кадры, движения камеры, синхронизацию диалогов и звук, а пиксели поступили от GPT Image 2.5 и Seedance 2.5[2]. Это руководство разбирает этот конвейер на части, проверяет каждый шаг против собственной документации вендоров и показывает, как запустить все три модели от одного ключа API.

TL;DR

  • Opus 5.5 планирует, не рендерит. В этом рабочем процессе он пишет каждый промпт; GPT Image 2.5 рисует стили, а Seedance 2.5 создает движущийся, говорящий кадр[2].
  • Описывайте оператора камеры, а не "реальность". Ключевой трюк разбора — сказать модели, кто держит камеру и где они сидят, что производит нестабильное колебание, поиск фокуса и смещения экспозиции[2].
  • GPT Image 2.5 — якорь идентичности. OpenAI говорит, что он "лучше сохраняет субъекты в ваших справочных фотографиях"[3], что именно то, что нужно листу персонажей.
  • Seedance 2.5 хочет структуру. Руководство ByteDance просит пронумерованные привязки активов (Image 1, Image 2), промежутки без пропусков и явные отрицательные управления, такие как "No subtitles"[4].
  • Стоимость доминируется видеосекундами. Два 10-секундных 1080p видео Seedance 2.5 стоят $9.24 на reAPI; два стиля и запуск планирования Opus 5.5 добавляют менее доллара[5][6][7].

Почему видеогенерация Opus 5.5 начинается со сценария

Видеомодели вознаграждают специфичность и наказывают неоднозначность. ByteDance говорит об этом прямо в своем руководстве Seedance 2.5: написание промпта "в основном влияет на следование инструкциям, согласованность материала и управляемость генерации", и это не меняет основные ограничения модели[4]. То же руководство предупреждает, что слишком мало сюжета в диапазоне времени позволяет модели импровизировать, в то время как слишком много производит чрезмерные переходы или пропущенные удары[4].

Это проблема письма, и здесь сильная языковая модель оправдывает свою стоимость. Один снимок Seedance 2.5 в разборе Reddit занимает более 1200 слов: справочный блок, блокировку камеры, четыре синхронизированных удара с диалогами и эмоциональными сигналами, раздел внешнего вида, раздел звука и список отрицаний[2]. Сохранение всего этого согласованным между несколькими кадрами вручную утомительно. Просить Opus 5.5 содержать библиотеку персонажей в контексте и излучать каждый промпт — нет.

Собственный рекламный материал Anthropic для Opus 5.5 посвящен именно этому виду дисциплины. Он говорит, что модель "ставит самую важную информацию в первую очередь" и "следует правилам письма, которые вы ей даете"[8]. Для генерации промпта, следующие вашему шаблону каждый раз важнее, чем стиль.

Один комментатор разбора назвал это использованием языковой модели для работы видеомодели. Другой ответил на практический момент: "эти промпты массивны, и сложно держать всё в голове и правильно форматировать в каждом промпте"[2]. Тот же комментатор отметил стоимость этого подхода: Claude обычно добавляет "кучу мусора" когда вы просите исправления, поэтому редактируйте шаблон, а не результат.

Четырёхэтапный конвейер, шаг за шагом

ЭтапМодельВходВыход
1. ДиректорClaude Opus 5.5Одна концепция, скриншоты стиля, ваш шаблон промптаБиблиотека персонажей, промпты изображений, синхронизированные видеопромпты
2. Лист персонажаGPT Image 2.5Фото субъекта + справочники стиля + промпт листаОдин лист 16:9: развороты, выражения, панели деталей
3. Стартовый кадрGPT Image 2.5Лист персонажа + промпт сценыТочный первый кадр снимка
4. СнимокSeedance 2.5Лист персонажа + стартовый кадр + синхронизированный промпт10-секундный клип с диалогом и фоновым звуком

Промпт листа персонажей разбора — хороший шаблон для копирования. Он просит ряд разворотов с шестью углами и ряд пяти выражений плюс панель деталей и указывает "Identity is locked, no drift between panels", при этом отмечая изображения стиля как "STYLE ONLY"[2]. Это различие имеет значение: справочник стиля, который не помечен, может пропустить своего человека в ваш персонаж.

Стартовый кадр — это место, где внешний вид запекается. Автор поместил оценку начала 2000-х с наведением и наводкой в сам промпт изображения, а не в постфильтр: "35mm film, 28mm wide lens with slight barrel distortion", "lifted blacks", "fine visible film grain"[2]. Затем Seedance 2.5 обрабатывает этот кадр как главный справочник для расположения, света и оценки.

Для этапов 2 и 3 GPT Image 2.5 поступает в двух версиях. OpenAI позиционирует Flare как "default choice for most applications" и Sunburst для "premium visual workflows that benefit from tighter control across edits"[3]. Лист персонажей, который вы будете повторно использовать для каждого снимка — разумное место, чтобы потратить дополнительные $0.002 за изображение на Sunburst.

Трюк с оператором камеры и что добавляет руководство Seedance

Деталь, которую выделили комментаторы, была второй точкой автора: не просите "реалистичное видео". Скажите кто держит камеру, где они сидят, и как они движутся[2]. Автор сообщает, что одна строка, "my friend is filming from the back seat", была достаточной, чтобы Opus 5.5 написал микротрясение, отсроченное кадрирование, поиск фокуса и смещения экспозиции в промпт.

Это работает, потому что Seedance 2.5 понимает простой язык камеры. ByteDance указывает размеры снимков, движения, такие как "push in", "orbit", и "handheld shake", углы, такие как "first-person perspective", и техники, такие как длинные кадры, как термины, которые вы можете писать напрямую[4]. Оператор камеры с расположением и телом дает модели причину последовательно их использовать.

Пять дополнительных правил из официального руководства принадлежат шаблону, который вы передаёте Opus 5.5:

  1. Пронумеруйте и привяжите каждый актив. Обратитесь к загрузкам как Image 1, Image 2 в порядке загрузки и укажите каждую привязку в тексте. ByteDance советует не полагаться на метки, рисуемые внутри изображения[4].
  2. Сохраняйте временные метки непрерывными. Напишите "0-3 seconds... 3-7 seconds..." и избегайте промежутков; не используйте временные метки для быстрых повторяющихся действий, таких как "shake your head three times per second"[4].
  3. Скажите, что вы не хотите в аудио. "No BGM; generate only environmental sounds and action sounds" и "No subtitles" оба поддерживаемые отрицания[4].
  4. Поместите произносимые строки в двойные кавычки. примечание reAPI по Seedance 2.5, что цитируемые строки направляют генерируемую речь[9].
  5. Бюджетируйте сюжет по диапазону времени. Каждый этап должен содержать одно четкое событие и конечное состояние[4].

ByteDance также публикует официальный навык оптимизации промптов Seedance 2.5. Его руководство рекомендует устанавливать его с помощью npx --yes skills@latest add "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" --skill sd25-pe --yes, затем печатая /sd25-pe с последующим вашим промптом в окне чата ИИ[4]. Opus 5.5 может подготовить снимок, и навык может затем проверить его против собственных условностей ByteDance.

Директорский промпт для Opus 5.5

Каждый запуск видеогенерации Opus 5.5 начинается с того же блока инструкций. Это стартовый шаблон, а не расшифровка сессии автора Reddit. Замените части в скобках.

You are the director and prompt writer for a short live-action AI video.
Concept: [one paragraph]
Style references: Image 2 and Image 3 are STYLE ONLY (grade, lens, grain).
Subject: Image 1 is the person. Identity must never drift.
Camera operator: [who films, where they sit, what device, how they move].

Produce, in order:
1. A character bible: face, hair, wardrobe, jewelry, props. Fixed wording.
2. A GPT Image 2.5 prompt for a 16:9 character sheet (turnaround,
   five expressions, detail panels, "Identity is locked").
3. A GPT Image 2.5 prompt for the start frame of shot 1.
4. A Seedance 2.5 prompt per shot, 10 seconds each, with:
   - Asset bindings: "Image 1 = identity, Image 2 = start frame"
   - A camera section written from the operator's point of view
   - Continuous timestamps (0-3s, 3-5s, 5-8.5s, 8.5-10s), one event each
   - Dialogue in double quotes, with emotion cues per phrase
   - Audio: on-camera mic only, list ambient sounds, "No BGM" if needed
   - Negatives: "No subtitles", no cuts unless requested, no morphing
Reuse the character bible wording verbatim in every prompt.

Последняя строка — та, которая предотвращает дрейф. Если каждый промпт описывает ожерелье немного иначе, видеомодель тоже будет.

Запуск Opus 5.5, GPT Image 2.5 и Seedance 2.5 от одного ключа

Все три модели находятся за одним ключом reAPI. Opus 5.5 использует эндпоинт завершения чата с ID модели claude-opus-5-5[1]. GPT Image 2.5 и Seedance 2.5 асинхронны: вы отправляете, получаете ID задачи и опрашиваете GET /api/v1/tasks/{id} до тех пор, пока статус не будет completed[9][10].

import time, requests

BASE = "https://reapi.ai/api/v1"
H = {"Authorization": "Bearer YOUR_API_KEY"}

def wait(task_id):
    while True:
        t = requests.get(f"{BASE}/tasks/{task_id}", headers=H).json()
        if t["status"] in ("completed", "failed"):
            return t
        time.sleep(10)

# 1. Opus 5.5 writes the prompts (DIRECTOR_PROMPT = the template above)
plan = requests.post(f"{BASE}/chat/completions", headers=H, json={
    "model": "claude-opus-5-5",
    "messages": [{"role": "user", "content": DIRECTOR_PROMPT}],
    "reasoning_effort": "high",
    "max_tokens": 16000,
}).json()["choices"][0]["message"]["content"]
# parse SHEET_PROMPT, FRAME_PROMPT, SHOT_PROMPT out of `plan`

# 2. Character sheet from the subject photo and style references
sheet = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": SHEET_PROMPT,
    "image_urls": [SUBJECT_URL, STYLE_URL_1, STYLE_URL_2],
}).json()["id"])["output"]["image_urls"][0]

# 3. Start frame, anchored to the sheet
frame = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
    "model": "gpt-image-2.5-sunburst",
    "prompt": FRAME_PROMPT,
    "image_urls": [sheet],
}).json()["id"])["output"]["image_urls"][0]

# 4. The 10-second shot. Image 1 = sheet, Image 2 = start frame
shot = wait(requests.post(f"{BASE}/videos/generations", headers=H, json={
    "model": "doubao-seedance-2.5-face",
    "prompt": SHOT_PROMPT,
    "image_urls": [sheet, frame],
    "duration": 10,
    "resolution": "1080p",
    "size": "16:9",
}).json()["id"])["output"]["video_urls"][0]
print(shot)

Три детали из справочной документации стоит знать перед тем, как ее запустить. Каждое медиа-поле должно быть общедоступным URL HTTP(S); base64 и data: URI отклоняются[9]. Seedance 2.5 принимает до 30 справочных изображений, поэтому лист, стартовый кадр и несколько снимков реквизита легко подходят[9]. И Opus 5.5 всегда думает адаптивно; reasoning_effort меняет, как глубоко, а встроенное по умолчанию — среднее[1].

Стоимость одного запуска видеогенерации Opus 5.5

Цены ниже — это опубликованные ставки reAPI на 29 сентября 2026 года[5][6][7]. Строка Opus 5.5 предполагает сеанс планирования из 30000 входных токенов и 10000 выходных токенов. Эта цифра является иллюстрацией, а не измерением; длина вашего шаблона и уровень усилий двигают его.

ЭлементСтавкаКоличествоСтоимость
Opus 5.5 input$3.20 per 1M tokens30,000$0.096
Opus 5.5 output$16.00 per 1M tokens10,000$0.160
GPT Image 2.5 Sunburst$0.025 per image2$0.05
Seedance 2.5, 1080p$0.462 per second20 s$9.24
Totalabout $9.55

Видеосекунды составляют более 96% счета. Рычаги, которые имеют значение, все на стороне Seedance: 720p работает $0.267 в секунду ($5.34 для тех же 20 секунд), и уровень Seedance 2.5 Eco 1080p счета $0.347 в секунду ($6.94) с тем же телом запроса[7][9]. Разумная подпрограмма — это итерация при 720p до тех пор, пока производительность и камера не будут правильными, затем рендер хранилище при 1080p.

Для сравнения, Anthropic указывает на Opus 5.5 как на $4 input и $20 output на миллион токенов, и говорит, что это стоит примерно на 40% меньше, чем Opus 5 на типичных рабочих нагрузках[8]. В любом случае, директор — это дешевая часть.

Часто задаваемые вопросы

Может ли Claude Opus 5.5 генерировать видео самостоятельно?

Нет. Opus 5.5 — это языковая модель, вызываемая через завершение чата; она возвращает текст[1]. В рабочем процессе видеогенерации Opus 5.5 она пишет промпты, а видеомодель, такая как Seedance 2.5, рендерит клип.

Что такое навык Seedance 2.5?

Это официальный навык оптимизации промптов ByteDance для Seedance 2.5, названный sd25-pe. Руководство BytePlus устанавливает его с помощью npx skills и вызывает его, напечатав /sd25-pe плюс ваш промпт в окне чата ИИ[4].

Как долго может быть видео Seedance 2.5?

До 30 секунд на поколение. На reAPI duration принимает 4-30 секунд или -1, чтобы дать модели выбрать[9]. Рабочий процесс Reddit использовал 10-секундные снимки и склеил их вместе[2].

Сколько стоит клип Opus 5.5 и Seedance 2.5?

Примерно $9.55 за два 10-секундных снимка 1080p, два стиля GPT Image 2.5 Sunburst и один сеанс планирования при предполагаемых выше подсчетах токенов. Рендеринг при 720p приносит примерно $5.65[5][6][7].

Должен ли я использовать GPT Image 2.5 Flare или Sunburst для листа персонажей?

Sunburst, если лист будет якорить несколько снимков. OpenAI описывает его как предлагающий "более плотное управление над правками"; Flare — более быстрый вариант по умолчанию[3]. На reAPI разница составляет $0.023 и $0.025 за изображение[6].

Мне нужен Claude Code для этого рабочего процесса?

Нет. Приведённый выше скрипт вызывает Opus 5.5 через простой HTTP. Anthropic действительно предлагает Opus 5.5 в Claude Code, включая быстрый режим[8], и это удобное место для итерации на шаблоне или запуска навыка sd25-pe. Конвейер производства требует только ключ API.

Может ли Opus 5.5 спланировать музыкальный видеоклип?

Он может написать список снимков, синхронизацию и направление звука. Seedance 2.5 генерирует речь, звуковые эффекты и фоновую музыку с клипом, и он также принимает справочное аудио (до 10 дорожек, 30 секунд всего), поэтому песня может управлять редактированием[9].

Пусть Opus 5.5 будет режиссёром, а Seedance 2.5 — съёмочной группой

Схема, разошедшаяся по r/Seedance_AI, работает по скучной причине: каждый промпт длинный, конкретный и последовательный, а языковая модель пишет такие промпты лучше уставшего человека. Дайте Opus 5.5 фиксированный шаблон, описание персонажа, которое нужно повторять слово в слово, и оператора камеры с конкретным местом и устройством. Пусть GPT Image 2.5 зафиксирует лицо, а бюджет на итерации тратьте на секунды Seedance 2.5 в 720p до финального рендера в 1080p. Это и есть генерация видео с Opus 5.5, которая доходит до результата: одна модель думает, две рендерят, и один API-ключ на все три — на reAPI.

References

  1. reAPI. Claude Opus 5.5 API: model ID, parameters and pricing. Retrieved September 2026 from reapi.ai/docs/claude-opus-5-5
  2. r/Seedance_AI. Full Breakdown: How I used Claude Opus & Seedance 2.5 to achieve photorealistic AI videos (All Prompts Included). Posted September 24, 2026. Retrieved September 2026 from reddit.com/r/Seedance_AI/comments/1wop0ju
  3. OpenAI. Introducing ChatGPT Images 2.5. September 8, 2026. Retrieved September 2026 from openai.com/index/introducing-chatgpt-images-2-5
  4. BytePlus ModelArk. Dreamina Seedance 2.5 prompt guide. Retrieved September 2026 from docs.byteplus.com/en/docs/modelark/seedance-2-5-prompt-guide
  5. reAPI. Claude Opus 5.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/claude-opus-5-5
  6. reAPI. GPT Image 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/gpt-image-2-5
  7. reAPI. Seedance 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/seedance-2-5
  8. Anthropic. Introducing Claude Opus 5.5. Retrieved September 2026 from anthropic.com/claude-opus-5-5
  9. reAPI. Seedance 2.5 API: parameters, modes and billing. Retrieved September 2026 from reapi.ai/docs/seedance-2-5
  10. reAPI. GPT Image 2.5 API reference. Retrieved September 2026 from reapi.ai/docs/gpt-image-2-5