Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 pro Sekunde

FLUX 3 — ein multimodales Modell für Video, Bild und Audio

FLUX 3 ist das multimodale Basismodell von Black Forest Labs, gemeinsam trainiert auf Bildern, Video und Audio in einer einzigen Architektur. Als KI-Videogenerator erzeugt FLUX 3 Bild und Ton zusammen — bis zu 20 Sekunden in einer Generierung — und folgt dabei Keyframes, Referenzclips und mehrsprachigen Dialogen.

Kernmerkmale
5–20 s · HD / FHD · Entwurf-dann-Finalisierung Workflow
Geeignet für
Kinematische Clips, Video-zu-Video Umgestaltung
Eingabe
Text, bis zu 10 Bilder oder ein Quellvideo
Ausgabe
Video (mp4), optionales Audio
Input

Erforderlich · Dialog, Atmo und Text im Bild lassen sich in einem Prompt beschreiben

5

Ganzzahl, 5 bis 20 Sekunden

Standard hd · Entwurfsvorschauen gibt es nur in hd

Standard auto · sieben feste Verhältnisse verfügbar

Standardmäßig an · ein stummer Clip ist nicht günstiger

Estimated cost~$0.782782 credits
Result

Try one of these prompts

Was ist die FLUX 3 API?

FLUX 3 ist das multimodale Foundation-Modell von Black Forest Labs; abrufbar ist heute seine Videofähigkeit. reAPI stellt sie als einen asynchronen Endpunkt mit drei Modi bereit: Text-zu-Video, Bild-zu-Video aus bis zu 10 Referenzbildern und Video-zu-Video als Fortsetzung eines vorhandenen Clips. Die Clips laufen 5 bis 20 Sekunden in HD oder FHD über sieben feste Seitenverhältnisse plus auto, Audio wird standardmäßig mitgeneriert, und ein Draft-Modus liefert günstige Vorschauen vor dem finalen Rendering. Abgerechnet wird pro Sekunde, zu einem Satz, der sich aus Modus, Auflösung und aktiviertem Draft ergibt.

FLUX 3 Beispielbilder aus Fotografie, Malerei, flacher Illustration und Produktrendering

Was du mit diesem Modell bauen kannst

Echte Workflows und produktionsreife Use Cases, die du mit diesem Modell bauen und ausliefern kannst.

FLUX 3 Multi-Input-Steuerung: Prompt, Startbild, Referenzclip und Keyframes steuern einen Übergang

FLUX 3 mit mehr als einem Prompt steuern

Text ist der Ausgangspunkt, nicht die ganze Anweisung. Gib FLUX 3 ein erstes Bild zum Animieren, Referenzbilder, die eine Figur festlegen, einen Quellclip, dessen Elemente in eine neue Szene übergehen sollen, oder zwei Keyframes, die Anfang und Ende eines Übergangs definieren. FLUX 3 kann außerdem ein vorhandenes Video samt Audio fortsetzen, sodass sich eine Einstellung verlängern lässt, statt sie neu zu erzeugen.

FLUX 3 Doku lesen
FLUX 3 lokalisiert eine Bäckerei-Szene auf Englisch, Spanisch, Japanisch und Französisch

Eine Kampagne lokalisieren, ohne neu zu drehen

FLUX 3 beherrscht mehrsprachige Dialoge und rendert lesbaren Text im Bild, sodass eine kreative Richtung zwischen Märkten reisen kann. Schilder, Titel und animierte Typografie entstehen als Teil der Szene statt nachträglich komponiert zu werden, und die Tonspur wird zusammen mit dem Bild erzeugt — genau dort ist FLUX 3 laut den eigenen frühen Auswertungen von Black Forest Labs zu Mimik und Mehrsprachigkeit bereits am stärksten.

FLUX 3 verfeinert das Produktbild eines Parfümflakons und überführt es in Bewegung

Ein Produkt vom Standbild in Bewegung bringen

Dasselbe FLUX 3 Backbone synthetisiert und bearbeitet Bilder über Stile, Seitenverhältnisse und Auflösungen hinweg und führt diese Standbilder anschließend in Bewegung über. Form, Farbe, Material und Branding bleiben zwischen Packshot und Clip wiedererkennbar, weil beides aus einem Modell kommt statt aus einem Bildgenerator mit angeflanschtem Videogenerator.

Preise

Credit-basiert — 1 Credit = 0,001 USD. Du zahlst nur für erfolgreich abgeschlossene Generierungen.

Kosten des ersten Tests
$0.276276 credits

Ein 5-Sekunden-Sample in der günstigsten Stufe.

Testbudget-Leitfaden
Credits aufladen
$10
≈ 36 Tests
$50
≈ 181 Tests
$100
≈ 362 Tests
ModellKategoriePreis
flux-3-videoEntwurfsvorschau – hd
$0.056
56 credits · 1 second
Fortsetzungsentwurf – hd
$0.111
111 credits · 1 second
Text oder Keyframes – hd
$0.157
157 credits · 1 second
Text oder Keyframes – fhd
$0.267
267 credits · 1 second
Videofortsetzung – hd
$0.378
378 credits · 1 second
Videofortsetzung – fhd
$0.488
488 credits · 1 second

Warum reAPI

Ein Fundament statt drei zusammengenähter Systeme

FLUX 3 lernt aus Bildern, Video und Audio innerhalb einer einheitlichen Architektur auf Basis von Self-Flow, dem Ansatz von Black Forest Labs zur Ausrichtung multimodaler Generierung und Verständnis. Die Modalitäten beschränken einander: Der Ton muss zum Aufprall passen, die Bewegung muss der Masse gehorchen.

Ton entsteht mit dem Bild

Jede Videoausgabe von FLUX 3 bringt natives Audio aus derselben Generierung mit — Dialog, Atmo und Aufprallgeräusche landen auf dem Frame, zu dem sie gehören, statt nachträglich auf stumme Aufnahmen getimt zu werden.

Auf der günstigen Stufe iterieren

Bei den meisten Videomodellen kostet jeder Versuch gleich viel, Ausprobieren wird also teuer. FLUX 3 trennt das: Entwurfsvorschauen laufen zu etwa einem Drittel des Satzes, und beim Finalisieren wird genau dieser Entwurf in voller Qualität neu gerendert — mit seinem eigenen Prompt, seinem Timing und seinen Eingaben. Den vollen Satz zahlst du einmal, für die Aufnahme, die du wirklich behältst.

FLUX 3 vs. Seedance 2.0

In den eigenen frühen Auswertungen von Black Forest Labs liegen diese beiden von allem Verglichenen am dichtesten beieinander — Betrachtende bevorzugten FLUX 3 in 52% der Vergleiche, praktisch ein Münzwurf. Der Unterschied liegt im Umfang: beide sind heute auf reAPI aufrufbar, aber Seedance 2.0 ist ein Videomodell, während FLUX 3 ein breiteres multimodales Fundament ist, dessen Bild- und Action-Stufen noch ausgerollt werden.

Fähigkeit
FLUX 3
Seedance 2.0 auf reAPI
Umfang
Ein multimodales Fundament über Bild, Video, Audio und Handlungsvorhersage.
Videogenerierung mit optionalem Audio.
Cliplänge pro Generierung
Bis zu 20 Sekunden mit Audio in einem Durchlauf.
4 bis 15 Sekunden pro Anfrage.
Eingabetypen
Prompt, Startbild, Referenzbilder, Referenzclip, Referenzaudio und Keyframes für gesteuerte Übergänge.
Prompt, Bilder, Rollen für erstes/letztes Bild, Referenzvideo und Referenzaudio.
Audio
Natives Audio bei jeder Videoausgabe, erzeugt zusammen mit dem Bild.
Audiogenerierung ist ein expliziter Schalter pro Anfrage.
Mehrschnitt-Kontinuität
Agentische Verkettung von Clips zu mehrminütigen Sequenzen, zusammengehalten von visuellen Referenzen.
Letztes Bild zurückgeben und in die nächste Anfrage geben, um eine Einstellung fortzusetzen.
Verfügbarkeit
Auf reAPI live, Abrechnung pro Sekunde nach Modus und Auflösung, mit einer günstigeren Entwurfsstufe zum Iterieren.
Heute auf reAPI verfügbar, Abrechnung pro Sekunde nach Auflösung.

Der Vergleich spiegelt öffentlich dokumentiertes Verhalten zum Zeitpunkt des Schreibens wider. Der Wert von 52% stammt aus der eigenen vorläufigen Auswertung von Black Forest Labs mit 10-sekündigen 720p-Text-zu-Video-Clips mit Audio, bei einem Modell, das das Unternehmen selbst als noch in Entwicklung bezeichnet; Stichprobengröße und Methodik wurden nicht veröffentlicht, es handelt sich nicht um einen unabhängigen Benchmark.

In drei Schritten bereit für FLUX 3

  1. step 01

    API-Key erstellen

    Bei reAPI registrieren und einen Key erzeugen. Ein Key, ein Guthaben und dieselbe Request-Form über alle Modelle der Plattform hinweg.

    Öffnen
  2. step 02

    Die FLUX 3 Referenz lesen

    Die FLUX 3 Seite verfolgt, was Black Forest Labs tatsächlich veröffentlicht hat — Fähigkeiten, Eingabetypen und Rollout-Stand — und erhält Endpunkt, Parameter und Preise, sobald sie bestätigt sind.

    Öffnen
  3. step 03

    Heute mit einem verfügbaren Modell live gehen

    Videomodelle mit nativem Audio sind auf reAPI bereits aufrufbar. Baue die Integration jetzt gegen eines davon; der spätere Wechsel zu FLUX 3 ist eine Modell-ID und ein Parameter-Mapping.

    Öffnen
docs/api/flux-3

API-Referenz

Sofort einsetzbarer Code und die vollständige Parametertabelle.

curl -X POST https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flux-3-video",
    "prompt": "A rain-soaked cafe terrace at dusk, a tram rolls past",
    "duration": 5
  }'

Parametervalidierung fehlgeschlagen

Synchron abgelehnt, das fehlerhafte Feld wird benannt. Enum-Werte, Bereiche und URL-Felder prüfen — es wird nichts berechnet.

Authentifizierung oder Guthaben

401 bedeutet fehlender/ungültiger Bearer-Key; 402 bedeutet, die Reservierung übersteigt das Guthaben. Keys und Credits in der Konsole verwalten.

Inhalt oder Material abgelehnt

Referenzmaterial und Ausgaben durchlaufen eine automatische Prüfung. Abgelehnte Tasks schlagen mit klarer Fehlermeldung fehl und werden voll erstattet.

Task fehlgeschlagen oder Timeout

Ein fehlgeschlagener Task wird nie berechnet — die Reservierung wird automatisch erstattet. Task-ID behalten und erneut versuchen.

Häufig gestellte Fragen

Häufige Fragen zu diesem Modell.

FLUX 3 ist das multimodale Basismodell von Black Forest Labs. Es lernt Bilder, Video und Audio gemeinsam in einer Architektur, statt sie als getrennte Systeme zu behandeln, und BFL positioniert es als Schritt hin zu Modellen, die in physischen und digitalen Umgebungen wahrnehmen, vorhersagen und handeln.

start building

Bereit zum Start?

Probiere es im Playground aus oder hol dir einen API-Key, um direkt loszulegen.