Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 par seconde

FLUX 3 — un modèle multimodal pour la vidéo, l'image et l'audio

FLUX 3 est le modèle de base multimodal de Black Forest Labs, entraîné conjointement sur des images, de la vidéo et de l'audio dans une seule architecture. En générateur vidéo IA, FLUX 3 produit l'image et le son ensemble — jusqu'à 20 secondes en une génération — et suit keyframes, clips de référence et dialogues multilingues.

Points clés
5–20 s · HD / FHD · workflow brouillon-puis-finalisé
Idéal pour
Clips cinématographiques, restyle vidéo-sur-vidéo
Entrée
Texte, jusqu'à 10 images, ou vidéo source
Sortie
Vidéo (mp4), audio optionnel
Input

Obligatoire · dialogue, ambiance et texte à l'écran tiennent dans un seul prompt

5

Entier, de 5 à 20 secondes

hd par défaut · les aperçus brouillon sont en hd uniquement

auto par défaut · sept formats fixes disponibles

Activé par défaut · un clip muet ne coûte pas moins cher

Estimated cost~$0.782782 credits
Result

Try one of these prompts

Qu'est-ce que l'API FLUX 3 ?

FLUX 3 est le modèle de fondation multimodal de Black Forest Labs, et c'est sa capacité vidéo qui est appelable aujourd'hui : reAPI l'expose comme un endpoint asynchrone doté de trois modes — texte vers vidéo, image vers vidéo à partir de 10 images de référence au maximum, et vidéo vers vidéo en prolongement d'un clip existant. Les clips durent de 5 à 20 secondes en HD ou FHD, sur sept formats fixes plus auto, avec audio généré par défaut et un mode draft pour des aperçus peu coûteux avant le rendu final. La facturation se fait à la seconde, à un tarif défini par le mode, la résolution et l'activation ou non du mode draft.

Images d'exemple FLUX 3 : photographie, peinture, illustration plate et rendus produit

Ce que tu peux construire avec ce modèle

Des workflows réels et des cas d'usage en production que tu peux construire et déployer avec ce modèle.

Contrôle multi-entrées de FLUX 3 : prompt, image de départ, clip de référence et keyframes pilotant une transition

Piloter FLUX 3 autrement que par le prompt

Le texte est le point de départ, pas la totalité des consignes. Tu peux donner à FLUX 3 une première image à animer, des images de référence qui verrouillent un personnage, un clip source dont les éléments doivent passer dans une nouvelle scène, ou deux keyframes qui définissent le début et la fin d'une transition. FLUX 3 sait aussi prolonger une vidéo existante et son audio : un plan s'allonge au lieu d'être régénéré depuis zéro.

Lire la doc FLUX 3
FLUX 3 localisant la devanture d'une boulangerie en anglais, espagnol, japonais et français

Localiser une campagne sans retourner le tournage

FLUX 3 gère le dialogue multilingue et affiche du texte lisible dans le cadre : une même direction créative peut donc voyager d'un marché à l'autre. Enseignes, titres et typographie animée sont générés comme éléments de la scène plutôt que composités après coup, et la piste parlée sort en même temps que l'image — précisément là où FLUX 3 est déjà le plus solide, d'après les évaluations initiales de Black Forest Labs sur l'expression faciale et le multilingue.

FLUX 3 affinant le visuel produit d'un flacon de parfum et le prolongeant en mouvement

Faire passer un produit du fixe au mouvement

Le même backbone FLUX 3 synthétise et retouche des images à travers styles, formats et résolutions, puis prolonge ces images fixes en mouvement. Forme, couleur, matière et identité de marque restent reconnaissables entre le packshot et le clip, parce que les deux sortent d'un seul modèle et non d'un générateur d'images auquel on aurait greffé un générateur vidéo.

Tarifs

Basé sur les crédits — 1 crédit = 0,001 USD. Tu ne paies que les générations réussies.

Coût du premier test
$0.276276 credits

Un échantillon de 5 secondes au palier le moins cher.

Guide de budget de test
Ajouter des crédits
$10
≈ 36 tests
$50
≈ 181 tests
$100
≈ 362 tests
ModèleCatégoriePrix
flux-3-videoAperçu brouillon — hd
$0.056
56 credits · 1 second
Brouillon de prolongation — hd
$0.111
111 credits · 1 second
Texte ou keyframes — hd
$0.157
157 credits · 1 second
Texte ou keyframes — fhd
$0.267
267 credits · 1 second
Prolongation vidéo — hd
$0.378
378 credits · 1 second
Prolongation vidéo — fhd
$0.488
488 credits · 1 second

Pourquoi reAPI

Une seule base, pas trois systèmes recousus

FLUX 3 apprend des images, de la vidéo et de l'audio au sein d'une architecture unifiée bâtie sur Self-Flow, l'approche de Black Forest Labs pour aligner génération et compréhension multimodales. Les modalités se contraignent mutuellement : le son doit coller à l'impact, le mouvement doit obéir à la masse.

Le son est généré avec l'image

Chaque sortie vidéo de FLUX 3 embarque un audio natif issu de la même génération — dialogue, ambiance et impacts tombent sur l'image à laquelle ils appartiennent, au lieu d'être recalés après coup sur des rushes muets.

Itérer sur le palier le moins cher

La plupart des modèles vidéo facturent chaque essai au même tarif : explorer coûte donc cher. FLUX 3 sépare les deux — les aperçus brouillon tournent à environ un tiers du tarif, et la finalisation régénère ce même brouillon en pleine qualité avec son propre prompt, son timing et ses entrées. Tu ne paies le plein tarif qu'une fois, pour la prise que tu gardes vraiment.

FLUX 3 vs Seedance 2.0

Dans les propres évaluations initiales de Black Forest Labs, ces deux-là sont les plus proches de toutes les comparaisons menées : les spectateurs ont préféré FLUX 3 dans 52% des duels, soit à peu près un pile ou face. La différence tient à l'étendue : les deux sont appelables sur reAPI aujourd'hui, mais Seedance 2.0 est un modèle vidéo, tandis que FLUX 3 est une base multimodale plus large dont les étapes image et action sont encore en cours de déploiement.

Capacité
FLUX 3
Seedance 2.0 sur reAPI
Étendue
Une base multimodale couvrant image, vidéo, audio et prédiction d'action.
Génération vidéo avec audio optionnel.
Durée par génération
Jusqu'à 20 secondes avec audio en une passe.
4 à 15 secondes par requête.
Types d'entrée
Prompt, image de départ, images de référence, clip de référence, audio de référence et keyframes pour transitions contrôlées.
Prompt, images, rôles première/dernière image, vidéo et audio de référence.
Audio
Audio natif sur chaque sortie vidéo, généré avec l'image.
La génération audio est une option explicite par requête.
Continuité multi-plans
Enchaînement agentique des clips en séquences de plusieurs minutes, tenues par des références visuelles.
Renvoyer la dernière image et l'injecter dans la requête suivante pour prolonger le plan.
Disponibilité
Disponible sur reAPI, facturé à la seconde selon le mode et la résolution, avec un palier brouillon moins cher pour itérer.
Disponible aujourd'hui sur reAPI, facturé à la seconde selon la résolution.

La comparaison reflète le comportement publiquement documenté au moment de la rédaction. Le chiffre de 52% provient de l'évaluation préliminaire menée par Black Forest Labs elle-même sur des clips texte-vers-vidéo de 10 secondes en 720p avec audio, portant sur un modèle qu'elle décrit comme encore en développement ; ni la taille d'échantillon ni la méthodologie n'ont été publiées, et il ne s'agit pas d'un benchmark indépendant.

Se préparer à FLUX 3 en trois étapes

  1. step 01

    Créer une clé API

    Inscris-toi sur reAPI et génère une clé. Une clé, un solde, et la même forme de requête sur tous les modèles de la plateforme.

    Ouvrir
  2. step 02

    Lire la référence FLUX 3

    La page FLUX 3 suit uniquement ce que Black Forest Labs a réellement publié — capacités, types d'entrée, étape de déploiement — et recevra endpoint, paramètres et tarifs dès leur confirmation.

    Ouvrir
  3. step 03

    Livrer dès aujourd'hui avec un modèle disponible

    Des modèles vidéo à audio natif sont déjà appelables sur reAPI. Construis l'intégration sur l'un d'eux maintenant : basculer vers FLUX 3 ensuite se réduit à un id de modèle et un mapping de paramètres.

    Ouvrir
docs/api/flux-3

Référence API

Code prêt à l'emploi et tableau complet des paramètres.

curl -X POST https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "flux-3-video",
    "prompt": "A rain-soaked cafe terrace at dusk, a tram rolls past",
    "duration": 5
  }'

Échec de validation des paramètres

Rejet synchrone avec le champ fautif nommé. Vérifiez enums, plages et champs URL — rien n'est facturé.

Problème d'authentification ou de solde

401 : clé Bearer absente ou invalide ; 402 : la réserve dépasse votre solde. Gérez clés et crédits dans la console.

Contenu ou matériel rejeté

Le matériel de référence et les sorties passent une modération automatique. Les tâches rejetées échouent avec une erreur claire et un remboursement intégral.

Tâche échouée ou expirée

Une tâche en état d'échec n'est jamais facturée — la réserve est remboursée automatiquement. Conservez l'ID et réessayez.

Questions fréquentes

Questions courantes sur ce modèle.

FLUX 3 est le modèle de base multimodal de Black Forest Labs. Il apprend conjointement des images, de la vidéo et de l'audio dans une seule architecture plutôt que de les traiter comme des systèmes séparés, et BFL le présente comme une étape vers des modèles qui perçoivent, prédisent et agissent dans des environnements physiques et numériques.

start building

Prêt à déployer ?

Essaie-le dans le playground ou récupère une clé API pour intégrer dès maintenant.