Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Передача ключевого кадра: рабочий процесс Seedream и Seedance
2026/07/27

Передача ключевого кадра: рабочий процесс Seedream и Seedance

Seedream определяет композицию дёшево, Seedance передаёт ключевой кадр видео. Рабочий процесс передачи: что контролирует каждый этап и где ломается система.

Генерация видео с нуля страдает структурной проблемой, которую не решить никаким промптом: изменение одной детали переписывает весь кадр. Настроишь свет — черты лица сдвигаются. Исправишь лицо — фон уплывает. Каждая попытка — это переброс.

Выход — перестать просить одну модель делать два дела. Зафиксируй кадр сначала изображением, потом передай утверждённый кадр видеомодели как референс. Это рабочий процесс Seedream Seedance, и его ценность не в качестве выше. Ценность в том, что утверждение становится неподвижным.

TL;DR

  • Два этапа, две модели. Seedream 5.0 Pro определяет, как выглядит сцена. Seedance управляет движением.
  • Передача — это референсное изображение, не переописание. Утверждённый кадр поступает как image_urls.
  • Seedream принимает до 10 референсов с привязанными правками и многоязычной типографией в 2K.
  • Итерируй дёшево на неподвижном кадре, где регенерация стоит центы и секунды, а не доллары и минуты.
  • Утвердить движение до деталей. Как только camera move правильный, оставшиеся правки локальны.
  • Некоторые утверждения о многоуровневом рабочем процессе не выдерживают проверки. Мы прошли через них отдельно в что на самом деле выходит.

Почему разделение работает

Двухэтапный конвейер: модель изображения определяет композицию, свет, геометрию и типографию, затем передаёт один утверждённый ключевой кадр видеомодели, которая управляет camera path, скоростью и beats

Генерация видео дорога в обоих смыслах: она стоит дороже за вызов, чем изображение, и займёт достаточно времени, чтобы плохой результат впустил впустую реальное время. Пропускать каждое творческое решение через такой цикл — вот почему команды говорят, что сжигают большую часть расписания на переделку.

Расщепление конвейера меняет стоимость каждой итерации.

Первый этап дёшев и быстр. Композиция, освещение, геометрия товара, типография, цвет бренда. Это решения в режиме неподвижного кадра, и определение их на изображении означает, что каждая попытка стоит несколько центов и возвращается в секунды.

Второй этап наследует уже определённый кадр. Генерация движения начинается с уже одобренного, а не с переопределения сцены из абзаца. Меньше переменных движется, так что меньше вещей ломается.

Экономический аргумент прямой: дорогой вызов должен работать один раз, после того как дешёвые вызовы убрали неопределённость.

Этап один: определи кадр

Seedream 5.0 Pro — это этап создания активов. Что важно для передачи:

До 10 референсных изображений с привязанными правками, так что товар или персонаж могут быть зафиксированы, а не описаны.

Многоязычная типография в 2K, сохраняя точный цвет и раскладку, что важно, когда кадр несёт текст бренда, который должен выжить в видео.

Оплата по пиксельному бюджету, разделена на 2.36M пиксели. Кадр 16:9 при 2048×1152 попадает в более дешёвый уровень, что как раз подходит для большинства ключевых кадров. Детали в разбивке цены.

Выход этого этапа — не папка вариантов. Это один утверждённый кадр на кадр, плюс промпт, который его произвёл.

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedream-5-0-pro",
    "prompt": "product hero on a stone counter, soft window light from camera left, brand wordmark legible on the label",
    "image_urls": ["https://example.com/packshot.jpg"],
    "size": "2048x1152"
  }'

Этап два: передай кадр дальше

Передача — это часть, которую люди переделывают неправильно. Инстинкт — переописать утверждённый кадр снова в видеопромпте. Это переводит ровно ту неопределённость, которую первый этап убрал.

Передай сам кадр:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "0-5s: [locked medium] no camera movement, steam rises from the cup. 5-12s: [slow dolly in] 0.3 m/s, product stays centered. Do not add text or logos.",
    "image_urls": ["https://cdn.example.com/approved-keyframe.png"],
    "resolution": "1080p",
    "duration": 12
  }'

Заметь, что делает видеопромпт и что не делает. Он описывает движение и ограничения. Он не переописывает освещение, композицию или товар, потому что референсный кадр уже их несёт.

Это разделение — дисциплина. Всё видимое в ключевом кадре принадлежит ключевому кадру, а не промпту движения.

Что контролирует каждый этап

РешениеЭтапПочему
Композиция и кадрированиеИзображениеДёшево итерировать, дорого исправлять в движении
Направление освещенияИзображениеДрейфует, если только описано в видеопромпте
Геометрия товара и логотипИзображениеПривязано референсом, а не сгенерировано
Типография и текст брендаИзображениеГде текстовая отрисовка сильнейшая
Camera path и скоростьВидеоДвижение — работа видеомодели
Timing и beatsВидеоСтруктурированная во времени структура с движением
Негативные ограниченияОбаПодавление текста важно в каждом этапе

Строки, которые генерируют больше всего путаницы — это освещение и кадрирование. Оба кажутся как они принадлежат видеопромпту, потому что финальный выход оттуда. Размещение их там означает переопределение их на каждой генерации.

Откуда на самом деле приходит сбережение

Утверждения о 60%-более-быстрой-итерации, плывущие вокруг этого рабочего процесса — маркетинговые цифры, не измерения. Механизм под ними реален, и стоит его сформулировать ясно, чем как процент.

Отклонённый неподвижный кадр стоит одну генерацию изображения. Отклонённое видео стоит генерацию видео плюс ожидание.

Одобренный неподвижный кадр переиспользуем. Один и тот же ключевой кадр может управлять несколькими вариантами движения, разными длительностями, разными camera move, без регенерации сцены.

Локальные правки остаются локальны. Исправление highlight на ключевом кадре не нарушает camera move, который ты уже одобрил, потому что move ещё не сгенерирован.

Это третий пункт — то, что команды открывают поздно. Последовательность одобрения так, чтобы дешёвые решения определились первыми — это не хак производительности, это то, что делает дорогой вызов стоящим.

Где конвейер ломается

Переописание кадра в видеопромпте. Самая частая ошибка. Это даёт видеомодели разрешение переинтерпретировать то, что уже было определено.

Одобрение ключевого кадра при неправильном соотношении сторон. Генерируй неподвижный кадр при соотношении сторон, которое будет использоваться в видео. Обрезка ключевого кадра 1:1 в 16:9 кадр переводит решения кадрирования.

Пропуск неподвижного кадра для "простых" кадров. Простые кадры — это ровно то, где неподвижный кадр дешевейший, так что коэффициент сбережения самый высокий.

Трактовка референса как предложения. Если выход дрейфует от ключевого кадра, добавь явные ограничения, привязывающие видео к нему, вместо переписания описания.

FAQ

Почему использовать две модели вместо одного text-to-video вызова?

Потому что text-to-video вызов переопределяет весь кадр каждый раз, так что изменение одной детали меняет всё. Определение кадра сначала делает одобрение устойчивым через итерации.

Что именно передаётся между этапами?

Утверждённый ключевой кадр как референсное изображение, плюс промпт движения. Визуальное описание не повторяется.

Должен ли видеопромпт описывать освещение?

Нет. Всё видимое в ключевом кадре принадлежит ключевому кадру. Промпт движения охватывает camera path, timing и ограничения.

Какое соотношение сторон должно быть у ключевого кадра?

Такое же, как будет в видео. Генерация неподвижного при другом соотношении и его обрезка переводит решение кадрирования, которое ты уже принял.

Может ли один ключевой кадр управлять несколькими видео?

Да, и это много ценности. Разные длительности, camera move и cutdown могут использовать утверждённый кадр без регенерации сцены.

Это работает для многокадровых последовательностей?

Да. Одобри один ключевой кадр за кадр, затем генерируй движение каждого кадра из его собственного референса. Согласованность между кадрами приходит из того, что неподвижные кадры используют общие референсы, а не из одного длинного промпта.

Утверждения о многоуровневых выходах об этом рабочем процессе точны?

Несколько широко повторяемых спецификаций не выдерживают проверку против официальных таблиц возможностей. Мы проверили их в что на самом деле выходит.

Последовательность одобрения, не просто генерация

Рабочий процесс Seedream Seedance описывается как техника качества, но это не совсем так. Обе модели производят то, что они производят, связаны вы их или нет.

Что связывание меняет — это порядок, в котором решения становятся финальными. Композиция, освещение и деталь бренда определяются на поверхности, где быть неправым стоит центы. Движение генерируется один раз, против кадра, который уже никто не обсуждает. Конвейер стоит строить по этой причине одной, и команды, которые говорят о наибольших выгодах — те, которые переместили одобрение раньше, а не те, которые нашли лучший промпт.

References

  1. Volcano Engine. Семейства моделей Seedream и Seedance. Retrieved July 2026 from volcengine.com

Further reading