Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Seedream zu Seedance: Der Keyframe-Übergabe-Workflow
2026/07/27

Seedream zu Seedance: Der Keyframe-Übergabe-Workflow

Mit Seedream wird Komposition günstig als Bild geklärt, dann übergibt man einen Keyframe ans Videomodell. Wer was verantwortet und wo die Pipeline bricht.

Text-zu-Video hat ein strukturelles Problem, das kein Prompt behebt: Wenn du ein Detail änderst, schreibst du die ganze Szene um. Justiere die Beleuchtung und das Gesicht des Charakters verschiebt sich. Repariere das Gesicht und der Hintergrund bewegt sich. Jede Iteration ist ein neuer Wurf.

Die Lösung ist, nicht eine Aufgabe von zwei verschiedenen Modellen erwarten zu lassen. Sperr den Frame erst mit einem Bildmodell, dann übergib den genehmigten Frame ans Videomodell als Referenz. Das ist der Seedream-Seedance-Workflow, und sein Wert ist nicht höhere Qualität pro Generierung. Es ist, dass Genehmigung dauerhaft wird.

TL;DR

  • Zwei Phasen, zwei Modelle. Seedream 5.0 Pro legt fest, wie die Szene aussieht. Seedance verwaltet, was sich bewegt.
  • Die Übergabe ist ein Referenzbild, keine Neubeschreibung. Der genehmigte Frame wird als image_urls übergeben.
  • Seedream kann bis zu 10 Referenzen mit verankerten Edits und mehrsprachiger Typografie in 2K verwenden.
  • Iteriere günstig am Still, wo eine Regeneration Cents und Sekunden kostet statt Dollar und Minuten.
  • Genehmige Bewegung vor Details. Sobald die Kamerabewegung stimmt, sind verbleibende Fixes lokal.
  • Einige Aussagen zu geschichteten Workflows halten sich nicht. Wir haben sie in was wirklich ausgeliefert wird separat durchgegangen.

Warum Entkopplung funktioniert

Zweiphasen-Pipeline: Ein Bildmodell legt Komposition, Beleuchtung, Geometrie und Typografie fest, dann übergibt es einen genehmigten Keyframe ans Videomodell, das Kamerafahrt, Geschwindigkeit und Beats übernimmt

Eine Videogenerierung ist teuer in beiden Sinnen: Sie kostet mehr pro Aufruf als ein Bild und dauert lang genug, dass ein schlechtes Ergebnis echte Zeit kostet. Jede kreative Entscheidung durch diese Schleife zu drücken ist, warum Teams berichten, dass sie die meiste Zeit auf Nachbesserungen verbrennen.

Das Aufteilen der Pipeline ändert, was jede Iteration kostet.

Phase eins ist günstig und schnell. Komposition, Beleuchtung, Produktgeometrie, Typografie, Markenfarbe. Dies sind Standbildentscheidungen, und sie auf einem Bildmodell zu regeln bedeutet, dass jeder Versuch ein paar Cent kostet und in Sekunden zurückkommt.

Phase zwei erbt einen geregelten Frame. Bewegungsgenerierung beginnt mit etwas bereits Genehmigtem statt die Szene aus einem Absatz neu abzuleiten. Weniger Variablen bewegen sich, also weniger Dinge brechen.

Das wirtschaftliche Argument ist geradlinig: Der teure Aufruf sollte einmal laufen, nachdem die günstigen Aufrufe die Unsicherheit weggeräumt haben.

Phase eins: Regeln Sie den Frame

Seedream 5.0 Pro ist der Asset-Schritt. Was für die Übergabe wichtig ist:

Bis zu 10 Referenzbilder mit verankerten Edits, damit ein Produkt oder Charakter gepinnt statt beschrieben wird.

Mehrsprachige Typografie in 2K, unter Beibehaltung exakter Farbe und Layout, was wichtig ist, wenn der Frame Markentext trägt, der ins Video überleben muss.

Pixelbudget-Abrechnung, geteilt bei 2,36 Millionen Pixeln. Ein 16:9-Frame bei 2048×1152 landet in der günstigeren Stufe, was für die meisten Keyframes die richtige Größe ist. Details stehen in der Preisaufschlüsselung.

Der Output dieser Phase ist nicht ein Ordner voller Optionen. Es ist ein genehmigter Frame pro Shot, plus der Prompt, der ihn erzeugt hat.

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedream-5-0-pro",
    "prompt": "product hero on a stone counter, soft window light from camera left, brand wordmark legible on the label",
    "image_urls": ["https://example.com/packshot.jpg"],
    "size": "2048x1152"
  }'

Phase zwei: Den Frame weitergeben

Die Übergabe ist der Teil, den Menschen falsch machen. Der Instinkt ist, den genehmigten Frame wieder in den Videoprompt zu beschreiben. Das bringt genau die Mehrdeutigkeit zurück, die Phase eins entfernt hat.

Übergeben Sie den Frame selbst:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "0-5s: [locked medium] no camera movement, steam rises from the cup. 5-12s: [slow dolly in] 0.3 m/s, product stays centered. Do not add text or logos.",
    "image_urls": ["https://cdn.example.com/approved-keyframe.png"],
    "resolution": "1080p",
    "duration": 12
  }'

Beachten Sie, was der Videoprompt tut und nicht tut. Er beschreibt Bewegung und Constraints. Er beschreibt nicht die Beleuchtung, die Komposition oder das Produkt erneut, weil der Referenzframe diese bereits trägt.

Diese Aufteilung ist die Disziplin. Alles Sichtbare im Keyframe gehört in den Keyframe, nicht in den Motion-Prompt.

Was jede Phase übernimmt

EntscheidungPhaseWarum
Komposition und FramingBildGünstig zu iterieren, teuer in Bewegung zu beheben
BeleuchtungsrichtungBildDriftet, wenn nur im Videoprompt beschrieben
Produktgeometrie und LogoBildVerankert durch Referenz statt generiert
Typografie und MarkentextBildWo Textrendering am stärksten ist
Kamerafahrt und GeschwindigkeitVideoBewegung ist des Videomodells Aufgabe
Timing und BeatsVideoZeitgestempelte Struktur gehört zur Bewegung
Negative ConstraintsBeideTextsuppression zählt in jeder Phase

Die Reihen, die die meiste Verwirrung auslösen, sind Beleuchtung und Framing. Beide fühlen sich an, als würden sie in den Videoprompt gehören, weil das ist, wo die finale Ausgabe herkommt. Sie dort einzufügen bedeutet, sie bei jeder Generierung neu zu entscheiden.

Wo die Einsparungen wirklich herkommen

Die 60%-schneller-Iterations-Behauptungen, die um diesen Workflow herumschwirren, sind Marketing-Zahlen, keine Messungen. Der Mechanismus darunter ist aber echt, und es lohnt sich, ihn klar zu formulieren statt als Prozentsatz.

Ein abgelehnter Still kostet eine Bildgenerierung. Ein abgelehntes Video kostet eine Videogenerierung plus den Warteaufwand.

Ein genehmigter Still ist wiederverwendbar. Der gleiche Keyframe kann mehrere Motion-Varianten antreiben, verschiedene Dauern, verschiedene Kamerabewegungen, ohne die Szene neu zu generieren.

Lokale Edits bleiben lokal. Eine Highlight auf dem Keyframe zu beheben stört eine Kamerabewegung nicht, die du bereits genehmigt hast, weil die Bewegung noch nicht generiert wurde.

Das dritte Punkt ist das, das Teams spät entdecken. Das Sequenzieren der Genehmigung, damit die günstigen Entscheidungen zuerst regeln, ist kein Produktivitäts-Hack, es ist das, das den teuren Aufruf wert macht.

Wo die Pipeline bricht

Den Frame im Videoprompt neu beschreiben. Der häufigste Fehler. Er gibt dem Videomodell die Erlaubnis, was bereits geregelt war, neu zu interpretieren.

Einen Keyframe in falscher Seitenverhältnis genehmigen. Generiere den Still im Seitenverhältnis, das das Video verwenden wird. Einen 1:1-Keyframe in einen 16:9-Shot zu schneiden bringt Framingentscheidungen zurück.

Den Still für "einfache" Shots überspringen. Einfache Shots sind genau, wo der Still am günstigsten ist, also ist das Einsparungsverhältnis am höchsten.

Die Referenz als Vorschlag behandeln. Wenn die Ausgabe vom Keyframe abdriftet, füge explizite Constraints hinzu, die das Video daran binden, statt die Beschreibung umzuschreiben.

FAQ

Warum zwei Modelle statt einen Text-zu-Video-Aufruf?

Weil ein Text-zu-Video-Aufruf die ganze Szene jedes Mal neu ableitet, also jede Detailänderung alles andere ändert. Wenn man den Frame zuerst regelt, wird die Genehmigung über Iterationen haltbar.

Was genau wird zwischen den Phasen übergeben?

Der genehmigte Keyframe als Referenzbild, plus ein Motion-Prompt. Die visuelle Beschreibung wird nicht wiederholt.

Sollte der Videoprompt die Beleuchtung beschreiben?

Nein. Alles Sichtbare im Keyframe gehört in den Keyframe. Der Motion-Prompt behandelt Kamerafahrt, Timing und Constraints.

Welches Seitenverhältnis sollte der Keyframe haben?

Das gleiche, das das Video verwenden wird. Einen Still in einem anderen Verhältnis zu generieren und zu schneiden bringt die Framingentscheidung zurück, die du bereits gemacht hast.

Kann ein Keyframe mehrere Videos antreiben?

Ja, und das ist ein Großteil des Wertes. Verschiedene Dauern, Kamerabewegungen und Schnitte können einen genehmigten Frame teilen, ohne die Szene neu zu generieren.

Funktioniert das für mehrshotige Sequenzen?

Ja. Genehmige einen Keyframe pro Shot, dann generiere jedes Shots Motion aus seiner eigenen Referenz. Konsistenz über Shots kommt daher, dass die Stills Referenzen teilen, nicht aus einem langen Prompt.

Sind die Behauptungen über mehrstufige Outputs zu diesem Workflow genau?

Mehrere weit verbreitete Spezifikationen halten sich nicht gegen die offiziellen Fähigkeitstabellen. Wir haben sie in was wirklich ausgeliefert wird überprüft.

Genehmigung sequenzieren, nicht nur Generierung

Der Seedream-Seedance-Workflow wird als Qualitätstechnik beschrieben, aber das ist er nicht wirklich. Beide Modelle produzieren, was sie produzieren, unabhängig davon, ob du sie kettest oder nicht.

Was Ketzen ändert, ist die Reihenfolge, in der Entscheidungen endgültig werden. Komposition, Beleuchtung und Markendetail bekommen auf einer Oberfläche geregelt, wo falsch Cents kostet. Bewegung wird einmal generiert, gegen einen Frame, den niemand mehr diskutiert. Die Pipeline lohnt sich für diesen Grund allein zu bauen, und die Teams, die die größten Gewinne melden, sind diejenigen, die die Genehmigung früher verschoben haben, nicht diejenigen, die einen besseren Prompt gefunden haben.

References

  1. Volcano Engine. Seedream and Seedance model families. Retrieved July 2026 from volcengine.com

Further reading