xAI
Grok Imagine 1.0 Video
Desde $0.009 por segundo
FLUX 3 es el modelo base multimodal de Black Forest Labs, entrenado conjuntamente con imágenes, vídeo y audio en una sola arquitectura. Como generador de vídeo IA, FLUX 3 produce imagen y sonido a la vez — hasta 20 segundos en una generación — y sigue keyframes, clips de referencia y diálogos multilingües.
Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

El texto es el punto de partida, no todas las instrucciones. Puedes darle a FLUX 3 un primer fotograma para animar, imágenes de referencia que fijen un personaje, un clip de origen cuyos elementos deban pasar a una escena nueva, o dos keyframes que definan dónde empieza y termina una transición. FLUX 3 también puede continuar un vídeo existente y su audio, así que un plano se alarga en lugar de regenerarse desde cero.
Leer la documentación de FLUX 3
FLUX 3 maneja diálogo multilingüe y renderiza texto legible dentro del plano, así que una misma dirección creativa puede viajar entre mercados. Los carteles, los títulos y la tipografía animada se generan como parte de la escena en vez de componerse después, y la pista hablada sale junto con la imagen — justo donde FLUX 3 ya es más fuerte, según las propias evaluaciones tempranas de Black Forest Labs sobre expresión facial y trabajo multilingüe.

El mismo backbone de FLUX 3 sintetiza y edita imágenes entre estilos, relaciones de aspecto y resoluciones, y después extiende esos bodegones al movimiento. La forma, el color, el material y la marca siguen siendo reconocibles entre el packshot y el clip, porque ambos salen de un solo modelo y no de un generador de imágenes con un generador de vídeo pegado al lado.
FLUX 3 aprende de imágenes, vídeo y audio dentro de una arquitectura unificada construida sobre Self-Flow, el enfoque de Black Forest Labs para alinear generación y comprensión multimodal. Las modalidades se restringen entre sí: el sonido tiene que coincidir con el impacto y el movimiento tiene que obedecer a la masa.
Cada salida de vídeo de FLUX 3 lleva audio nativo de la misma generación: diálogo, ambiente e impactos caen en el fotograma al que pertenecen, en lugar de sincronizarse después sobre metraje mudo.
FLUX 3 encadena generaciones individuales en secuencias de varios planos que duran minutos, con referencias visuales que mantienen estables personajes y localizaciones de escena a escena. Veinte segundos es el techo de una generación, no el de la pieza terminada.
En las propias evaluaciones tempranas de Black Forest Labs, estos dos quedaron más cerca que cualquier otra comparación: los espectadores prefirieron FLUX 3 en el 52% de los enfrentamientos, prácticamente una moneda al aire. La diferencia está en la disponibilidad y el alcance: Seedance 2.0 se puede llamar hoy mismo en reAPI, mientras que FLUX 3 es una base multimodal más amplia todavía en despliegue por fases.
La comparación refleja el comportamiento documentado públicamente en el momento de escribir. La cifra del 52% procede de la evaluación preliminar de la propia Black Forest Labs con clips de texto a vídeo de 10 segundos a 720p con audio, sobre un modelo que describe como todavía en desarrollo; no se publicaron el tamaño de muestra ni la metodología, y no es un benchmark independiente.
Regístrate en reAPI y genera una key. Una key, un saldo y la misma forma de petición para todos los modelos de la plataforma.
AbrirLa página de FLUX 3 sigue lo que Black Forest Labs ha publicado de verdad — capacidades, tipos de entrada y fase de despliegue — y recibirá endpoint, parámetros y tarifas en cuanto se confirmen.
AbrirLos modelos de vídeo con audio nativo ya se pueden llamar en reAPI. Monta la integración con uno de ellos ahora y pasar después a FLUX 3 será un id de modelo y un mapeo de parámetros.
AbrirDudas comunes sobre este modelo.
Explora más modelos de la misma categoría.
xAI
Desde $0.009 por segundo
PixVerse
Desde $0.018 por segundo
Topaz Labs
Desde $0.044 por segundo
ByteDance
Desde $0.029 por segundo
Pruébalo en el playground o consigue una API key para integrarlo ahora.