
Bild-zu-Video-API 2026: Preise, Eingaben und Grenzen
Vergleich von Bild-zu-Video-APIs: Eingabemodi Quellbild, Referenz und erste/letzte Frames über sechs Modelle hinweg mit Live-Preisen ab $0,03/s.
Wenn du eine Bild-zu-Video-API suchst, um Videogenerierung aus Standbildern zu automatisieren, liegt die Preisspanne im August 2026 bei $0,03 pro Sekunde Ausgabe bis $0,18 und darüber, und die größeren Unterschiede liegen darin, was „Bild-zu-Video" für jedes Modell bedeutet. Manche APIs animieren ein einzelnes Quellbild. Andere behandeln deine Bilder als Identitätsreferenzen und generieren eine neue Szene darum herum. Eine akzeptiert einen ersten und einen letzten Frame und füllt die Bewegung dazwischen.
Das sind drei verschiedene Aufgaben, und ein Modell nach Preis auszuwählen, bevor man die Eingabeform ausgewählt hat, führt dazu, dass Automatisierungs-Pipelines zweimal umgebaut werden. Dieser Leitfaden sortiert sechs Modelle zunächst nach Eingabeform, dann legt Live-Sekundenpreise und ein Automatisierungsskript gegen jedes, mit allen Zahlen von den Modellseiten auf reAPI im August 2026 gezogen.
TL;DR
- Billigster Weg, ein Standbild zu animieren, und billigste erste-und-letzte-Frame-Route: Seedance 2.0 Mini bei $0.049875/s für 480p-Bildgenerierung[2]. Seine $0.0315 Quellvideo-Rate gilt nicht für Bilder oder erste/letzte Frames.
- Einfachster Single-Image-Weg: Grok Imagine Video 1.5 nimmt genau ein Quellbild und läuft bei $0.03/s bei 480p auf seiner offiziellen Ebene, $0.06/s bei 720p[1].
- Meisten Referenzmöglichkeiten: Seedance 2.5 akzeptiert bis zu 30 Referenzbilder pro Anfrage[4]; MiniMax H3 nimmt 9 plus einen ersten und letzten Frame[5].
- Steuerung des ersten und letzten Frames ist das seltene Feature: von den sechs exponieren nur MiniMax H3 und Seedance 2.0 Mini beide Enden des Clips als Eingaben[2][5].
- Keine API auf dieser Liste bietet unbegrenzte kostenlose Generierung; Video-Inferenz ist zu teuer, um wegzugeben. Signup-Credits existieren zum Testen, und Pro-Sekunde-Abrechnung bedeutet, ein echtes Budget bleibt unter einem Dollar pro Test-Clip.
Drei Eingabeformen hinter „Bild-zu-Video"
Quellbild-Animation. Das Modell empfängt ein Bild und generiert Bewegung daraus: das Bild ist Frame eins oder nah dran. Grok Imagine Video 1.5 ist die reine Version dieser Form; sein image_urls-Feld ist erforderlich und nimmt genau ein Bild[1]. Das ist die Form, die Menschen üblicherweise mit „mein Foto zum Leben bringen" meinen.
Referenzgetriebene Generierung. Die Bilder steuern Identität, Produkt oder Stil, während das Modell eine neue Szene komponiert. Seedance 2.5 nimmt bis zu 30 Referenzbilder, Kling 3.0 und Vidu Q3 nehmen bis zu zwei[4][3][6]. Charakterkohärenz über eine Serie von Clips lebt hier. Bei Seedance 2.5 bleiben Bilder-Referenzen bei der $0.118589/s-480p-Basisrate; nur ein Quellvideo wählt die $0.071153-Rate, und seine Dauer wird auch berechnet[4].
Frame-Interpolation. Liefere den ersten Frame, optional den letzten, und das Modell verbindet sie. MiniMax H3 exponiert first_frame_url und last_frame_url zusammen mit bis zu neun Referenzbildern[5], und Seedance 2.0 Mini trägt dasselbe Bilderpaar plus neun Bild-Referenzen bei einem Bruchteil der Rate[2]. Das ist die steuerlastige Form für Storyboard-Aufnahmen.
Sechs Bild-zu-Video-APIs bei ihren Live-Rates
Alle sechs laufen hinter demselben Endpoint auf reAPI; Raten unten sind die aufgelisteten Pro-Sekunde-Preise, abgerufen im August 2026.
| Modell | Eingabeform | Bildplätze | Clip-Länge | Niedrigste aufgelistete Rate |
|---|---|---|---|---|
| Seedance 2.0 Mini | erste/letzte Frame + Refs | 9 + 2 Frames | 4–15 s | $0.049875/s bei 480p[2] |
| Vidu Q3 | Referenz | bis zu 2 | 1–16 s | $0.0368/s bei 540p Turbo[3] |
| Grok Imagine Video 1.5 | Quellbild (erforderlich) | 1 | 1–15 s | $0.03/s bei 480p[1] |
| MiniMax H3 | erste/letzte Frame + Refs | 9 + 2 Frames | 4–15 s | $0.1125/s bei 768P, Audio enthalten[5] |
| Kling 3.0 | Referenz | bis zu 2 | 3–15 s | $0.077/s, ohne Audio[6] |
| Seedance 2.5 | Referenz | bis zu 30 | 4–30 s | $0.118589/s bei 480p mit Bildeingabe[4] |
Auflösungsgrenzen unterscheiden sich: Grok endet bei 720p auf dieser Fläche[1], Vidu Q3 listet 1080p-Ebenen bis zu $0,1472/s[3], Kling 3.0 hat eine 4K-Ebene bei $0,3685/s[6]. Jedes Modell hier lehnt Base64-Uploads ab; Bilder gehen als öffentliche HTTPS-URLs ein.
Was acht Sekunden von einem Bild kosten
Derselbe Acht-Sekunden-Job, billigste anwendbare Ebene auf jedem Modell:
| Modell, Ebene | 8-Sekunden-Clip |
|---|---|
| Grok Imagine Video 1.5, offiziell 480p | $0,24[1] |
| Vidu Q3, Turbo 540p | $0,29[3] |
| Seedance 2.0 Mini, 480p mit Bildeingabe | $0,304[2] |
| Seedance 2.5, 480p mit Bild-Referenz | $0,949[4] |
| Kling 3.0, Standard ohne Audio | $0,62[6] |
| MiniMax H3, Standard mit Audio | $1,46[5] |
Die Spanne beträgt etwa 6× zwischen der billigsten Ebene und der teuersten, weshalb die Eingabeform-Entscheidung zuerst kommt. H3-Preise für ein einzelnes Produktfoto zu zahlen kauft Kontrolle, die du nicht nutzt; eine einzelne Stillarbeit in ein referenzgetriebenes Modell zu füttern und Frame-Eins-Treue zu erwarten, produziert eine andere Szene als du beabsichtigt.
Automatisierung der Pipeline in Python
Automatisierung ist eine Schleife: eine Aufgabe pro Bild einreichen, jede Aufgaben-ID abfragen, Ausgabe-URLs sammeln. Credits sind im Voraus bezahlt bei 1 Credit = $0,001 und fehlgeschlagene Aufgaben erhalten automatisch Rückerstattung, daher kostet eine schlechte URL im Batch nichts[1].
import requests, time
API = "https://reapi.ai/api/v1"
HEADERS = {"Authorization": "Bearer rk_live_..."}
images = [
"https://your-cdn.com/product-01.png",
"https://your-cdn.com/product-02.png",
]
tasks = []
for url in images:
r = requests.post(f"{API}/videos/generations", headers=HEADERS, json={
"model": "grok-imagine-video-1.5-beta",
"image_urls": [url],
"prompt": "Slow 180-degree orbit around the product, studio lighting",
"resolution": "480p",
"duration": 8,
}, timeout=30)
tasks.append(r.json()["id"])
for task_id in tasks:
while True:
poll = requests.get(f"{API}/tasks/{task_id}", headers=HEADERS).json()
if poll["status"] in ("completed", "failed"):
print(task_id, poll["status"], poll.get("output") or poll.get("error"))
break
time.sleep(2)Zwei Dinge zu respektieren in der Produktion: die Gesamtanfragerate unter dem Plattform-Limit von 5 Anfragen/Sekunde halten, inklusive Abfragen, und Quellbilder auf einem Host staging, der schnell served, da das Modell jede URL auf der Serverseite abruft.
Die „kostenlos unbegrenzt"-Frage
Eine wiederkehrende Suche ist eine Bild-zu-Video-AI, die kostenlos und unbegrenzt ist. Sie existiert nicht in dieser Aussage auf keiner Plattform, weil Video-Inferenz teure Beschleuniger für die volle Render-Zeit besetzt; alles, das als unbegrenzt vermarktet wird, misst dich woanders, durch Warteschlangen, Drossel, Wasserzeichen oder Auflösungsgrenzen. Was existiert: Signup-Credits ohne Karte erforderlich, genug, um echte Test-Aufrufe zu laufen, und Pro-Sekunde-Abrechnung danach. Bei den Raten oben kostet ein Acht-Sekunden-480p-Test etwa ein Viertel. Das Testen jedes Modells in dieser Tabelle auf deinem eigenen Material kostet etwa $3,86, was eine verteidigbare Zeilenposition beim Auswählen des Motors hinter einer automatisierten Pipeline ist.
FAQ
Kannst du APIs für die Automatisierung der Videogenerierung aus Bildern empfehlen?
Passe die API an die Aufgabe an: Grok Imagine Video 1.5 für das Animieren einzelner Stills bei $0.03/s[1], Seedance 2.5 für referenz-intensive Charakter- oder Produktarbeit[4], MiniMax H3, wenn du den ersten und letzten Frame fixieren musst[5]. Alle laufen durch einen Endpoint auf reAPI, daher bleibt der Automatisierungs-Code identisch, während du zwischen Modellen wechselst.
Gibt es kostenlose unbegrenzte Bild-zu-Video-AI?
Nein. GPU-Zeit macht unbegrenzte kostenlose Video-Generierung wirtschaftlich unmöglich, und Angebote mit dieser Formulierung messen durch Warteschlangen oder Ausgabegrenzen statt. Kostenlose Signup-Credits zum Testen plus Pro-Sekunde-Raten ab $0.049875/s ist die ehrliche Form des Marktes[2].
Welche Bild-zu-Video-API ist am billigsten?
Für einen ausschließlich bildgesteuerten Job startet Seedance 2.0 Mini bei $0.049875/s, Vidu Q3 Turbo bei $0.0368/s, und Grok Imagine Video 1.5 bei $0.03/s[1][2][3]. Minis niedrigere $0.0315 Rate erfordert ein tatsächliches Quellvideo und bildet Quelle plus Ausgabedauer ab, daher ist es nicht der Bild-zu-Video-Preis.
Kann ich sowohl den ersten als auch den letzten Frame steuern?
MiniMax H3 und Seedance 2.0 Mini akzeptieren beide first_frame_url und last_frame_url in einer Anfrage[2][5]. Das sind die Tools für storyboardete Sequenzen, wo Clip N's Ende Clip N+1's Start entsprechen muss.
Wie viele Referenzbilder kann ich senden?
Seedance 2.5 nimmt bis zu 30, MiniMax H3 und Seedance 2.0 Mini bis zu 9 jeweils, Kling 3.0 und Vidu Q3 bis zu 2, Grok Imagine Video 1.5 genau 1[1][3][4][5][6]. Mehr Plätze kosten mehr pro Sekunde, daher sende den Mindestsatz, der die Identität verriegelt, die du brauchst.
Enthalten Bild-zu-Video-Ausgaben Audio?
MiniMax H3 generiert immer Audio bei seiner pauschalen Rate; Seedance 2.5 versendet standardmäßig Audio; Kling 3.0 bepreist Audio- und Ohne-Audio-Ebenen getrennt[4][5][6]. Grok Imagine Video 1.5 und Vidu Q3 bepreisen nach Auflösungs-Ebene auf dieser Fläche.
Praktisch eine Eingabeform auswählen
Entscheide, was das Bild ist: der erste Frame, eine Referenz, oder einer von zwei Enden. Diese einzelne Entscheidung eliminiert die meisten der Tabelle. Dann lass den Preis die Überlebenden sortieren, und gib einen Batch von Signup-Credits für das Durchführen deiner eigenen Stills durch die zwei Finalisten aus, bevor du entweder in die Produktion verdrahtst. Eine Bild-zu-Video-API verdient ihren Platz in einer Pipeline, indem sie sich beim Bild fünfhundert genauso verhält wie beim Bild eins, und bei $0,24 pro Test-Clip beweist das kostet weniger als ein falscher Nachmittag Rework.
References
- reAPI. Grok Imagine Video 1.5 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/grok-imagine-video-1-5
- reAPI. Seedance 2.0 Mini — model page with live pricing and source-video billing. Retrieved August 17, 2026 from reapi.ai/models/seedance-2-0-mini
- reAPI. Vidu Q3 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/viduq3
- reAPI. Seedance 2.5 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/seedance-2-5
- reAPI. MiniMax H3 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/minimax-h3
- reAPI. Kling 3.0 — model page with live pricing and input schema. Retrieved August 2026 from reapi.ai/models/kling-3-0
Further reading
- reAPI. Hailuo AI compared: Seedance 2.5, Kling 3.0, Veo 3.1. reapi.ai/blog/hailuo-ai-vs-other-ai-video-generators
- reAPI. Seedance 2.0 vs Kling 3.0. reapi.ai/blog/seedance-2-0-vs-kling-3-0-2026
Autor

Kategorien
Weitere Beiträge

Seedream 5 Pro Inhaltsfilter: Was sie blockieren
Seedream 5 Pro nutzt mehrschichtige Filter. Ablehnung zeigt selten welche Schicht auslöste. Erfahre was blockiert wird und welche Grenzen bleiben.


Seedream zu Seedance: Der Keyframe-Übergabe-Workflow
Mit Seedream wird Komposition günstig als Bild geklärt, dann übergibt man einen Keyframe ans Videomodell. Wer was verantwortet und wo die Pipeline bricht.


7 Venice AI Alternativen für flexible Seedance 2.0 Video
Vergleich von Venice AI Alternativen für Seedance 2.0, multimodale Referenzen, echte Personenbilder und flexible Moderation in Bild- und Video-Workflows.
