
Seedance 2.5 Bilder zu Video: Frames, Eingaben und Kosten
Seedance 2.5 Bilder zu Video: First Frames, First/Last Frames und Referenzbilder. API-Felder, Echtpersonen-Eingaben und Kosten für 10-Sekunden-Anfragen.
Seedance 2.5 Bilder zu Video auf reAPI nutzt eine Modell-ID, doubao-seedance-2.5-face, mit unterschiedlichen Bildfeldern für verschiedene Aufgaben. Nutze einen expliziten First Frame, wenn der Clip von einer bestimmten Komposition starten soll, First und Last Frames, wenn beide Endpunkte wichtig sind, oder Referenzbilder, wenn du möchtest, dass das Modell visuelle Anleitung beim Aufbau einer neuen Szene nutzt.[1]
Die Unterscheidung beeinflusst das JSON, das du absendest. Frame-Rollen erfordern size: "adaptive"; Referenzbilder-Eingaben ermöglichen ein gewähltes Seitenverhältnis. Für eine zehn-sekündige 720p-Anfrage mit Bildern, aber ohne Referenzvideo, liegt der Preis am 12. September bei $2,669 nach Credits-Aufrundung. Der Seedance 2.5 Playground und die API-Dokumentation zeigen die verfügbaren Steuerelemente.[1][2]
TL;DR
- Nutze
image_with_rolesmitrole: "first_frame", um einen bestimmten visuellen Starting Frame anzufordern. Setzesizeaufadaptive.[1] - Füge einen
last_frameEintrag hinzu, wenn du einen zweiten Endpunkt benötigst. Ein Last Frame erfordert einen First Frame; jede Rolle darf höchstens einmal vorkommen.[1] - Nutze
image_urlsfür Referenzbilder. Die API akzeptiert bis zu 30, erfordert aber nicht, dass du das Limit ausfüllst.[1] - Echtpersonen-Referenzbilder werden auf reAPI unterstützt und automatisch überprüft. Eine Moderationsablehnung führt zu einem fehlgeschlagenen Task und wird erstattet.[2]
- Bildreferenzen erhöhen die abrechenbaren Quellsekunden nicht. Eine zehn-sekündige 720p-Anfrage mit Bild kostet 2.669 Credits zum September-12-Tarif ohne Video.[1][2]
Wähle die richtige Eingabeform für Seedance 2.5 Bilder zu Video
Entscheide, was das Bild steuern muss, bevor du ein Upload-Feld wählst. Ein Starting Frame definiert die anfängliche Komposition; ein Referenzbild kann stattdessen das Aussehen einer Person, eines Objekts oder einer Szene liefern. Das sind verschiedene Anweisungen, auch wenn du dieselbe Quelldatei nutzt.
| Dein Ziel | Anfrage-Feld | Seitenverhältnis | Was im Ergebnis prüfen |
|---|---|---|---|
| Eine bestimmte Starting-Komposition animieren | image_with_roles mit first_frame | adaptive | Eröffnungsframe, angeforderte Bewegung und unerwünschte Hintergrundänderungen |
| Zwischen zwei angegebenen Kompositionen wechseln | image_with_roles mit First und Last Rollen | adaptive | Beide Endpunkte und der Übergang zwischen ihnen |
| Eine oder mehrere visuelle Referenzen in einer neuen Szene nutzen | image_urls | Wähle ein akzeptiertes size | Identität, Objekterscheinungsbild und zugewiesene Rolle jeder Referenz |
Die Eingabefelder und Seitenverhältnisbeschränkungen sind dokumentiertes API-Verhalten. Die Prüf-Spalte ist eine redaktionelle Checkliste, kein Versprechen, dass ein Eingabefeld perfekte visuelle Beibehaltung garantiert.[1]
Beginne bei einer einfachen Fotoanimation mit einem expliziten First Frame und einer sichtbaren Aktion. Wenn das Ziel darin besteht, zwei referenzierte Personen an einem neu beschriebenen Ort zu platzieren, starte stattdessen mit Referenzbildern. Das Hinzufügen von mehr Quelldateien, bevor du weißt, welche Art von Kontrolle du brauchst, macht sowohl den Prompt als auch das Ergebnis schwerer zu interpretieren.
Animiere einen expliziten First Frame
Eine explizite First-Frame-Anfrage nutzt image_with_roles. Das folgende cURL-Beispiel nutzt ein bereits als öffentliches Beispiel verfügbares Porträt. Ersetze es durch dein eigenes zulässiges Quellbild und schreibe die Bewegung, die du sehen möchtest.
curl --fail-with-body https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer $REAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "The adult turns her head slightly toward the camera and gives a small natural smile. Keep the framing, hairstyle, white top and background stable. One continuous shot, no camera movement.",
"image_with_roles": [
{
"url": "https://file.deepytb.com/landing/qwen-image-2/playground-input.webp",
"role": "first_frame"
}
],
"duration": 4,
"resolution": "480p",
"size": "adaptive",
"generate_audio": false
}'Der Frame liefert die Ausgangskomposition, sodass sich der Prompt auf Bewegung konzentrieren kann. Beschreibe, welcher Gegenstand sich bewegt, in welche Richtung und was still bleiben soll. Vermeide es, den Großteil des Prompts darauf zu verwenden, Details zu beschreiben, die bereits sichtbar sind, es sei denn, diese Details sind besonders wichtig zu bewahren.
Für ein Porträt mit fester Kamera ist Kopf- oder Augenbewegung ein einfacherer erster Test als eine große Kamerafahrt, die unsichtbare Teile der Szene offenbaren würde. Für ein Produktfoto prüfst du Silhouette, Griff-Platzierung, Beschriftung und Reflexionen. Diese Prüfungen beurteilen das Ergebnis; sie sind keine Einstellungen, die das Modell zwingen, diese Details zu bewahren.
Das Absenden gibt eine Task-ID zurück. Frage diese Task ab, bis sie abgeschlossen ist, dann lese output.video_urls. Der API-Schnellstart bietet das vollständige Beispiel für das Absenden und die Statusabfrage.[1]
Verbinde einen First Frame und einen Last Frame
Nutze zwei explizite Rollen, wenn sowohl das Eröffnungs- als auch das Schlussbild wichtig sind. Es darf nur einen first_frame und einen last_frame geben, und letzterer kann nicht allein gesendet werden. Behalte size: "adaptive" bei, da die Ausgabe die Form der Frame-Eingabe folgt.[1]
{
"image_with_roles": [
{
"url": "https://your-public-storage.example/start.png",
"role": "first_frame"
},
{
"url": "https://your-public-storage.example/end.png",
"role": "last_frame"
}
],
"size": "adaptive"
}Das ist ein Fragment des Anfragekörpers, das du mit Modell, Prompt, Dauer und Auflösung zu einer vollständigen Anfrage ergänzt. Die zwei URLs sind Platzhalter. Lade die tatsächlichen Bilder in öffentlichen Speicher, bevor du das Beispiel nutzt; ein lokaler Dateipfad oder eine umbenannte Erweiterung ersetzen keine lesbare Mediendatei.
Wähle Endpunkte, die einen plausiblen Übergang beschreiben. Wenn die Öffnung eine sitzende Person zeigt und das Ende diese Person stehend zeigt, erkläre die Aktion des Aufstehens und gib ihr genug Zeit. Wenn die beiden Bilder auch Kleidung, Raumgeometrie und Kameraposition ändern, hat der Übergang mehr Änderungen zu bewältigen. Entscheide, welche dieser Änderungen du wirklich möchtest, anstatt ihre Interpretation implizit zu lassen.
Überprüfe die Mitte des Clips genauso sorgfältig wie die Endpunkte. Das Matching des Anfangs und des Endes ist nicht ausreichend, wenn die dazwischenliegende Bewegung einen Sprung, eine verzerrte Hand oder einen unerwarteten Schnitt enthält. Wenn der Übergang der Teil ist, den du verbessern musst, überarbeite die Aktion oder wähle näher beieinanderliegende Endpunkte, bevor du weitere stilistische Adjektive hinzufügst.
Weise jedem Referenzbild eine Aufgabe zu
Nutze image_urls für eine neue Komposition, die von mehreren Bildern geleitet wird. Die API akzeptiert bis zu 30 Referenzbilder, jedes unter dem dokumentierten Dateigrößenlimit. Bilder müssen über öffentliche HTTP(S)-URLs erreichbar sein; base64 Data URIs werden nicht akzeptiert.[1]
{
"model": "doubao-seedance-2.5-face",
"prompt": "Use Image1 for the adult in white and Image2 for the adult in black. Place both in a quiet gallery. The adult in white waves once; the adult in black nods. Keep their hairstyles and outfits distinct. Fixed camera.",
"image_urls": [
"https://file.deepytb.com/landing/qwen-image-2/playground-input.webp",
"https://file.deepytb.com/landing/grok-imagine-video-1-5/playground-input.png"
],
"duration": 4,
"resolution": "480p",
"size": "16:9",
"omni_reference_task_type": "reference",
"generate_audio": false
}Das erste Beispiel zeigt eine erwachsene Person mit langen Haaren und weißem Top. Das zweite ist ein Drei-Ansichten-Porträt einer erwachsenen Person mit kurzem Bob und dunkler Kleidung. Wenn du letzteres nutzt, gib an, dass seine Panels eine Identität darstellen, damit die beabsichtigte Szene klar ist. Die 20-Prompt-Bibliothek enthält den exakten längeren Prompt, der für den Zwei-Referenzen-Test und sein generiertes Ergebnis verwendet wird.
Kombiniere nicht image_urls und image_with_roles in einer Anfrage. Sie schließen sich gegenseitig aus. Halte auch explizite Frame-Rollen separat von reference_image-Rollen innerhalb von image_with_roles; die Dokumentation behandelt diese als verschiedene Anfrage-Formen.[1]
Das Hinzufügen von video_urls oder audio_urls neben expliziten Frame-Bildern ändert, wie diese Bilder verwendet werden: die Anfrage wird zu einer multimodalen Referenz-Aufgabe. Behandle die Frames als Referenz-Anleitung in dieser Kombination, anstatt dich auf den strikten First/Last-Frame-Workflow zu verlassen, der oben beschrieben wird.[1]
Wenn eine Referenz-Sammlung mehrere Subjekte enthält, wiederhole den Namen oder das visuelle Label des Subjekts, wenn Zugehörigkeit wichtig ist. „Die Person in Weiß hebt die Tasse" ist weniger mehrdeutig als „sie hebt sie" nach einem Absatz über zwei Personen. Halte Image1- und Image2-Labels mit der tatsächlichen Input-Reihenfolge ausgerichtet.
Lade Echtpersonen-Referenzen hoch und diagnostiziere Ausfälle
reAPI unterstützt Echtpersonen-Referenzbilder und -Videos für Seedance 2.5. Die Referenzen durchlaufen die automatisierte Überprüfung vor der Generierung, und abgelehnte Materialien erzeugen einen Fehler mit vollständiger Rückerstattung. Die Unterstützung des Input-Typs ist keine Garantie, dass jede einzelne Datei akzeptiert wird.[2]
Nutze Bilder, die du verwenden darfst, und prüfe die beabsichtigte Darstellung des Subjekts vor dem Absenden. Wenn eine Anfrage fehlschlägt, lies den Fehler, bevor du den Prompt umschreibst. Ein nicht erreichbare URL, ungültige Anfrage-Feld und Moderation-Ablehnung erfordern unterschiedliche Reaktionen.
| Fehler | Erste Prüfung |
|---|---|
| Quell-URL kann nicht gelesen werden | Bestätige, dass die direkte Medien-URL ohne angemeldete Browsersitzung funktioniert |
| Anfrage lehnt die Bildfelder ab | Prüfe gegenseitige Ausschlüsse und die First/Last-Frame-Rollen-Regeln |
| Seitenverhältnis-Fehler | Nutze adaptive mit expliziten Frame-Rollen |
| Nicht unterstütztes Format | Prüfe die tatsächliche Dateicodierung, nicht nur den Dateinamen |
| Moderation-Ablehnung | Überprüfe das Material und beabsichtigte Inhalte; inspiziere den zurückgegebenen Fehler |
Der Echtpersonen-Referenz-Fehler-Leitfaden bietet weitere Hinweise zur Fehlersuche. Für die exakten akzeptierten Dateiformate und Validierungsregeln nutze die aktuelle 2.5 Dokumentation.[1]
Was ein Bild und zehn Sekunden 720p kosten
Eine Anfrage ausschließlich mit Bildern nutzt den Tarif ohne Referenzvideo. Am 12. September liegt dieser Tarif bei $0,266824 pro Ausgabesekunde bei 720p. Zehn Sekunden kosten daher ceil(0.266824 × 10 × 1000) = 2669 Credits, oder $2,669.[2]
| Bild-Anfrage ohne Quellvideo | Ausgabe-Dauer | Zahlbare Summe |
|---|---|---|
| 480p | 4 Sekunden | 475 Credits / $0,475 |
| 720p | 10 Sekunden | 2.669 Credits / $2,669 |
| 1080p | 10 Sekunden | 4.619 Credits / $4,619 |
Diese Gesamtwerte nutzen die exakten angezeigten Tarife und runden die gesamte Anfrage auf einen Credit auf. Bildreferenzen addieren keine abrechenbaren Sekunden hinzu. Wenn du video_urls hinzufügst, ändert sich die Abrechnungsberechnung, um die Referenzvideo-Dauer und das dokumentierte Minimalfenster einzubeziehen.[1][2]
Behalte diese Unterscheidung bei, wenn du Input-Modi vergleichst. Eine Anfrage mit zwei Bildern ist immer noch eine Bilder-Referenz-Anfrage für diese Pricing-Frage; sie wird nicht automatisch zur Referenzvideo-Anfrage, nur weil sie mehr als ein Quell-Asset hat. Für eine breitere Modellauswahl siehe den Bilder-zu-Video-API-Leitfaden. Dieser Artikel behandelt die Seedance-spezifischen Feldwahlmöglichkeiten, nachdem du 2.5 ausgewählt hast.
FAQ
Seedance 2.5 Bild zu Video
Nutze doubao-seedance-2.5-face mit Bild-Eingaben. Wähle explizite Frame-Rollen für eine bestimmte Anfangs- oder Schlusskomposition, oder image_urls für Referenzbilder.[1]
Kann Seedance 2.5 ein Standbild animieren?
Ja. Für einen expliziten Starting Frame sende das Bild als first_frame in image_with_roles, setze size: "adaptive", und beschreibe die Bewegung.[1]
Seedance 2.5 erster und letzter Frame
Sende einen First-Frame-Eintrag und einen Last-Frame-Eintrag. Der Last Frame erfordert einen First Frame, und explizite Frame-Eingaben erfordern adaptive Größe.[1]
Referenzbilder realer Personen in Seedance 2.5 hochladen
Lade die Referenz auf eine öffentlich erreichbare Medien-URL hoch und übergib sie über das entsprechende Bildfeld. Echtpersonen-Referenzen werden unterstützt und automatisch überprüft.[1][2]
Seedance 2.5 kosten pro video
Eine zehn-sekündige 720p-Bildanfrage ohne Referenzvideo kostet am 12. September $2,669 nach Aufrundung auf ganze Credits. Andere Auflösungen und Dauern ändern den Preis.[2]
Seedance 2.5 referenzbilder
Die API akzeptiert bis zu 30 Bilder. Nutze nur die Referenzen, die du für die Szene brauchst, und gib an, was jedes im Prompt steuern soll.[1]
Beginne mit der Bildkontrolle, die die Szene braucht
Nutze einen Frame für eine bestimmte Eröffnung, zwei Frames für angegebene Endpunkte oder Referenzbilder für eine neu komponierte Szene. Halte den ersten Test kurz genug, um ihn genau zu überprüfen. Ein nützlicher Seedance-2.5-Bilder-zu-Video-Workflow beginnt mit einer klaren Rolle für das Bild und endet mit einer Überprüfung der tatsächlichen Bewegung.
Quellen
- reAPI. Seedance 2.5 API — Parameters, Modes & Billing. Browser-Abruf 12. September 2026. reapi.ai/docs/seedance-2-5.
- reAPI. Seedance 2.5 rendered pricing and real-person-reference FAQ. Browser-Abruf 12. September 2026. reapi.ai/models/seedance-2-5.
Autor

Kategorien
Weitere Beiträge

KI-Video-API-Preismodelle: pro Sekunde vs. Pauschal
Warum sich Preise von KI-Video-APIs nicht direkt vergleichen lassen: zwei inkompatible Abrechnungsmodelle, Break-Even-Punkte und was ein echtes Video kostet.


Beste Seedance-2.5-Alternativen: H3, Veo, Sora und mehr
Vergleich der besten Seedance-2.5-Alternativen für Videogenerierung, darunter MiniMax H3, Seedance 2.0, Veo 3.1, Sora 2, Runway und Kling 3.


Seedance 2.5 oder 2.0: Welcher passt zu deinem Job?
Seedance 2.5 vs Seedance 2.0 verglichen mit Live-Tarifen: 30s-Takes und Bearbeitung bei 2.5, 1080p/4K und günstigere Stufen bei 2.0. Nach Workload wählen.
