
Seedream zu Seedance: Der Keyframe-Übergabe-Workflow
Mit Seedream wird Komposition günstig als Bild geklärt, dann übergibt man einen Keyframe ans Videomodell. Wer was verantwortet und wo die Pipeline bricht.
Text-zu-Video hat ein strukturelles Problem, das kein Prompt behebt: Wenn du ein Detail änderst, schreibst du die ganze Szene um. Justiere die Beleuchtung und das Gesicht des Charakters verschiebt sich. Repariere das Gesicht und der Hintergrund bewegt sich. Jede Iteration ist ein neuer Wurf.
Die Lösung ist, nicht eine Aufgabe von zwei verschiedenen Modellen erwarten zu lassen. Sperr den Frame erst mit einem Bildmodell, dann übergib den genehmigten Frame ans Videomodell als Referenz. Das ist der Seedream-Seedance-Workflow, und sein Wert ist nicht höhere Qualität pro Generierung. Es ist, dass Genehmigung dauerhaft wird.
TL;DR
- Zwei Phasen, zwei Modelle. Seedream 5.0 Pro legt fest, wie die Szene aussieht. Seedance verwaltet, was sich bewegt.
- Die Übergabe ist ein Referenzbild, keine Neubeschreibung. Der genehmigte Frame wird als
image_urlsübergeben. - Seedream kann bis zu 10 Referenzen mit verankerten Edits und mehrsprachiger Typografie in 2K verwenden.
- Iteriere günstig am Still, wo eine Regeneration Cents und Sekunden kostet statt Dollar und Minuten.
- Genehmige Bewegung vor Details. Sobald die Kamerabewegung stimmt, sind verbleibende Fixes lokal.
- Einige Aussagen zu geschichteten Workflows halten sich nicht. Wir haben sie in was wirklich ausgeliefert wird separat durchgegangen.
Warum Entkopplung funktioniert

Eine Videogenerierung ist teuer in beiden Sinnen: Sie kostet mehr pro Aufruf als ein Bild und dauert lang genug, dass ein schlechtes Ergebnis echte Zeit kostet. Jede kreative Entscheidung durch diese Schleife zu drücken ist, warum Teams berichten, dass sie die meiste Zeit auf Nachbesserungen verbrennen.
Das Aufteilen der Pipeline ändert, was jede Iteration kostet.
Phase eins ist günstig und schnell. Komposition, Beleuchtung, Produktgeometrie, Typografie, Markenfarbe. Dies sind Standbildentscheidungen, und sie auf einem Bildmodell zu regeln bedeutet, dass jeder Versuch ein paar Cent kostet und in Sekunden zurückkommt.
Phase zwei erbt einen geregelten Frame. Bewegungsgenerierung beginnt mit etwas bereits Genehmigtem statt die Szene aus einem Absatz neu abzuleiten. Weniger Variablen bewegen sich, also weniger Dinge brechen.
Das wirtschaftliche Argument ist geradlinig: Der teure Aufruf sollte einmal laufen, nachdem die günstigen Aufrufe die Unsicherheit weggeräumt haben.
Phase eins: Regeln Sie den Frame
Seedream 5.0 Pro ist der Asset-Schritt. Was für die Übergabe wichtig ist:
Bis zu 10 Referenzbilder mit verankerten Edits, damit ein Produkt oder Charakter gepinnt statt beschrieben wird.
Mehrsprachige Typografie in 2K, unter Beibehaltung exakter Farbe und Layout, was wichtig ist, wenn der Frame Markentext trägt, der ins Video überleben muss.
Pixelbudget-Abrechnung, geteilt bei 2,36 Millionen Pixeln. Ein 16:9-Frame bei 2048×1152 landet in der günstigeren Stufe, was für die meisten Keyframes die richtige Größe ist. Details stehen in der Preisaufschlüsselung.
Der Output dieser Phase ist nicht ein Ordner voller Optionen. Es ist ein genehmigter Frame pro Shot, plus der Prompt, der ihn erzeugt hat.
curl https://reapi.ai/api/v1/images/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedream-5-0-pro",
"prompt": "product hero on a stone counter, soft window light from camera left, brand wordmark legible on the label",
"image_urls": ["https://example.com/packshot.jpg"],
"size": "2048x1152"
}'Phase zwei: Den Frame weitergeben
Die Übergabe ist der Teil, den Menschen falsch machen. Der Instinkt ist, den genehmigten Frame wieder in den Videoprompt zu beschreiben. Das bringt genau die Mehrdeutigkeit zurück, die Phase eins entfernt hat.
Übergeben Sie den Frame selbst:
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedance-2-5",
"prompt": "0-5s: [locked medium] no camera movement, steam rises from the cup. 5-12s: [slow dolly in] 0.3 m/s, product stays centered. Do not add text or logos.",
"image_urls": ["https://cdn.example.com/approved-keyframe.png"],
"resolution": "1080p",
"duration": 12
}'Beachten Sie, was der Videoprompt tut und nicht tut. Er beschreibt Bewegung und Constraints. Er beschreibt nicht die Beleuchtung, die Komposition oder das Produkt erneut, weil der Referenzframe diese bereits trägt.
Diese Aufteilung ist die Disziplin. Alles Sichtbare im Keyframe gehört in den Keyframe, nicht in den Motion-Prompt.
Was jede Phase übernimmt
| Entscheidung | Phase | Warum |
|---|---|---|
| Komposition und Framing | Bild | Günstig zu iterieren, teuer in Bewegung zu beheben |
| Beleuchtungsrichtung | Bild | Driftet, wenn nur im Videoprompt beschrieben |
| Produktgeometrie und Logo | Bild | Verankert durch Referenz statt generiert |
| Typografie und Markentext | Bild | Wo Textrendering am stärksten ist |
| Kamerafahrt und Geschwindigkeit | Video | Bewegung ist des Videomodells Aufgabe |
| Timing und Beats | Video | Zeitgestempelte Struktur gehört zur Bewegung |
| Negative Constraints | Beide | Textsuppression zählt in jeder Phase |
Die Reihen, die die meiste Verwirrung auslösen, sind Beleuchtung und Framing. Beide fühlen sich an, als würden sie in den Videoprompt gehören, weil das ist, wo die finale Ausgabe herkommt. Sie dort einzufügen bedeutet, sie bei jeder Generierung neu zu entscheiden.
Wo die Einsparungen wirklich herkommen
Die 60%-schneller-Iterations-Behauptungen, die um diesen Workflow herumschwirren, sind Marketing-Zahlen, keine Messungen. Der Mechanismus darunter ist aber echt, und es lohnt sich, ihn klar zu formulieren statt als Prozentsatz.
Ein abgelehnter Still kostet eine Bildgenerierung. Ein abgelehntes Video kostet eine Videogenerierung plus den Warteaufwand.
Ein genehmigter Still ist wiederverwendbar. Der gleiche Keyframe kann mehrere Motion-Varianten antreiben, verschiedene Dauern, verschiedene Kamerabewegungen, ohne die Szene neu zu generieren.
Lokale Edits bleiben lokal. Eine Highlight auf dem Keyframe zu beheben stört eine Kamerabewegung nicht, die du bereits genehmigt hast, weil die Bewegung noch nicht generiert wurde.
Das dritte Punkt ist das, das Teams spät entdecken. Das Sequenzieren der Genehmigung, damit die günstigen Entscheidungen zuerst regeln, ist kein Produktivitäts-Hack, es ist das, das den teuren Aufruf wert macht.
Wo die Pipeline bricht
Den Frame im Videoprompt neu beschreiben. Der häufigste Fehler. Er gibt dem Videomodell die Erlaubnis, was bereits geregelt war, neu zu interpretieren.
Einen Keyframe in falscher Seitenverhältnis genehmigen. Generiere den Still im Seitenverhältnis, das das Video verwenden wird. Einen 1:1-Keyframe in einen 16:9-Shot zu schneiden bringt Framingentscheidungen zurück.
Den Still für "einfache" Shots überspringen. Einfache Shots sind genau, wo der Still am günstigsten ist, also ist das Einsparungsverhältnis am höchsten.
Die Referenz als Vorschlag behandeln. Wenn die Ausgabe vom Keyframe abdriftet, füge explizite Constraints hinzu, die das Video daran binden, statt die Beschreibung umzuschreiben.
FAQ
Warum zwei Modelle statt einen Text-zu-Video-Aufruf?
Weil ein Text-zu-Video-Aufruf die ganze Szene jedes Mal neu ableitet, also jede Detailänderung alles andere ändert. Wenn man den Frame zuerst regelt, wird die Genehmigung über Iterationen haltbar.
Was genau wird zwischen den Phasen übergeben?
Der genehmigte Keyframe als Referenzbild, plus ein Motion-Prompt. Die visuelle Beschreibung wird nicht wiederholt.
Sollte der Videoprompt die Beleuchtung beschreiben?
Nein. Alles Sichtbare im Keyframe gehört in den Keyframe. Der Motion-Prompt behandelt Kamerafahrt, Timing und Constraints.
Welches Seitenverhältnis sollte der Keyframe haben?
Das gleiche, das das Video verwenden wird. Einen Still in einem anderen Verhältnis zu generieren und zu schneiden bringt die Framingentscheidung zurück, die du bereits gemacht hast.
Kann ein Keyframe mehrere Videos antreiben?
Ja, und das ist ein Großteil des Wertes. Verschiedene Dauern, Kamerabewegungen und Schnitte können einen genehmigten Frame teilen, ohne die Szene neu zu generieren.
Funktioniert das für mehrshotige Sequenzen?
Ja. Genehmige einen Keyframe pro Shot, dann generiere jedes Shots Motion aus seiner eigenen Referenz. Konsistenz über Shots kommt daher, dass die Stills Referenzen teilen, nicht aus einem langen Prompt.
Sind die Behauptungen über mehrstufige Outputs zu diesem Workflow genau?
Mehrere weit verbreitete Spezifikationen halten sich nicht gegen die offiziellen Fähigkeitstabellen. Wir haben sie in was wirklich ausgeliefert wird überprüft.
Genehmigung sequenzieren, nicht nur Generierung
Der Seedream-Seedance-Workflow wird als Qualitätstechnik beschrieben, aber das ist er nicht wirklich. Beide Modelle produzieren, was sie produzieren, unabhängig davon, ob du sie kettest oder nicht.
Was Ketzen ändert, ist die Reihenfolge, in der Entscheidungen endgültig werden. Komposition, Beleuchtung und Markendetail bekommen auf einer Oberfläche geregelt, wo falsch Cents kostet. Bewegung wird einmal generiert, gegen einen Frame, den niemand mehr diskutiert. Die Pipeline lohnt sich für diesen Grund allein zu bauen, und die Teams, die die größten Gewinne melden, sind diejenigen, die die Genehmigung früher verschoben haben, nicht diejenigen, die einen besseren Prompt gefunden haben.
References
- Volcano Engine. Seedream and Seedance model families. Retrieved July 2026 from volcengine.com
Further reading
- reAPI. Seedream 5.0 Pro Seedance 2.5 workflow: what actually ships. reapi.ai/blog/seedream-5-0-pro-seedance-2-5-workflow
- reAPI. Seedance 2.5 camera control. reapi.ai/blog/seedance-2-5-camera-control
- reAPI. Seedream 5.0 Pro price. reapi.ai/blog/seedream-5-0-pro-price
Autor

Kategorien
Weitere Beiträge

Kling Motion Control: v2.6 vs v3, Preise und Vorbereitung
Nutze Kling Motion Control v2.6 oder v3 mit korrekter Ausrichtung, Quelldauer, Preisstufe und Referenzbild, um Gesichts- und Körperdrift zu reduzieren.


Maximale LLM-Ausgabetokens: API-Limits und Kontextbudgets
Vergleiche LLM-Ausgabelimits, Denkbudgets und API-Parameter. Trenne Kontextfenster, Anfragegrenzen, Standardwerte und Claudes spezielle Batch-Erweiterung.


Die beste API-Plattform für KI-Designtools und Marketing-Tools
Vier API-Plattformen im direkten Vergleich: Anfragearchitektur, echte Preise und die Einsatzszenarien jeder Lösung. Welche passt zu deinem Projekt?
