Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 por segundo

Wan 3.0 — generación de vídeo multimodal de 30 segundos

Wan 3.0 es el modelo de vídeo de nueva generación de Alibaba, ya en beta pública. Como generador de vídeo con IA, Wan 3.0 crea clips de hasta 30 segundos en una sola pasada, acepta texto, imágenes, audio, vídeo e incluso documentos como entrada, y mantiene estables personajes, voces y estilo con un control de referencia detallado. Wan 3.0 llegará muy pronto a reAPI.

Próximamente — la API de este modelo aún no está disponible.

Lo que puedes construir con este modelo

Flujos de trabajo reales y casos de uso en producción que puedes construir y lanzar con este modelo.

Cuenta una historia de 30 segundos en una sola pasada

La mayoría de modelos de generación de vídeo se quedan cerca de los 10 segundos; se ha anunciado que Wan 3.0 genera hasta 30 segundos en una sola pasada, suficiente para una escena completa con principio, nudo y desenlace. En lugar de unir clips y pelearte con la deriva de continuidad, describes todo el arco una vez y Wan 3.0 lo renderiza como una única toma. Cuando se abra la API, esa misma generación en una sola pasada llegará aquí, a reAPI.

Ver la documentación preliminar

Dale a Wan 3.0 cualquier entrada, incluso documentos

Wan 3.0 acepta las cuatro modalidades base —texto, imágenes, audio y vídeo— y, por primera vez en la familia Wan, documentos: los archivos doc, xls, ppt, pdf y md pueden impulsar una generación. Una presentación se convierte en un explicativo de producto; un informe, en un clip resumen narrado. Con Wan 3.0 puedes crear vídeo con IA a partir del material que ya tienes, sin pasar por un storyboard.

Mantén fijos personajes, voces y estilo

Wan 3.0 lleva la generación por referencia a un control detallado: se ha anunciado que personajes, objetos de escena, voces, relaciones espaciales y estilo se mantienen estables entre tomas. Y la edición va más allá de volver a renderizar: Wan 3.0 permite modificar la imagen, la trama y los diálogos de un clip. Los personajes recurrentes y el aspecto de tu marca sobreviven de una generación a la siguiente.

Por qué reAPI

Un salto generacional en una sola pasada

Wan 3.0 lleva a la familia Wan de los clips cortos a escenas de 30 segundos en una sola pasada, con audio, coherencia de personajes y mejoras anunciadas en el renderizado del mundo real. Si hoy tu flujo une segmentos de 5 segundos, Wan 3.0 reduce ese trabajo a una única petición.

Entradas multimodales, salida en vídeo

Texto, imágenes, audio, vídeo y documentos impulsan el mismo modelo. Wan 3.0 enruta según lo que aportas —sin productos separados para texto a vídeo, imagen a vídeo, referencia a vídeo o edición—, así que una sola integración cubre todos los modos de generación de vídeo cuando Wan 3.0 llegue a reAPI.

Pago por uso desde el lanzamiento

Cuando Wan 3.0 se abra aquí, la facturación seguirá el estándar de la plataforma: por generación completada, escalada según la resolución y la duración, con reembolso automático de los trabajos fallidos. Sin suscripción: los créditos son de pago por uso y no caducan.

Wan 3.0 frente a Wan 2.7

Wan 3.0 sucede a la generación Wan 2.7, ya disponible. Las filas de abajo comparan lo que Alibaba anunció en la beta pública de Wan 3.0 con lo que Wan 2.7 documenta hoy en reAPI: comportamiento anunciado a un lado, comportamiento ya disponible al otro.

Capacidad
Wan 3.0 (anunciado)
Wan 2.7 en reAPI
Estado
En beta pública desde el 6 de agosto de 2026; la API del proveedor se abrirá del todo muy pronto. Próximamente en reAPI.
Ya disponible hoy en reAPI: playground, documentación y precio por segundo.
Duración máxima
Hasta 30 segundos en una sola pasada.
De 2 a 15 segundos en los modos base; los modos de referencia y edición tienen un tope menor.
Resoluciones
480P, 720P y 1080P.
720P y 1080P.
Modalidades de entrada
Texto, imagen, audio y vídeo, más documentos: doc, xls, ppt, pdf y md.
Texto, imagen, audio y vídeo.
Control por referencia
Detallado: personajes, objetos de escena, voces, relaciones espaciales y estilo anunciados como estables.
Las imágenes, los vídeos y las voces por sujeto de referencia mantienen los sujetos coherentes.
Edición
Anunciada para modificar imagen, trama y diálogos.
Vuelve a renderizar un vídeo de origen según un prompt; audio_setting controla la banda sonora.

Las filas de Wan 3.0 reflejan el anuncio de beta pública de Alibaba del 6 de agosto de 2026 y son provisionales hasta que la API esté disponible de forma general. Las filas de Wan 2.7 reflejan su comportamiento documentado en reAPI en el momento de redactarse.

Prepárate para Wan 3.0 en tres pasos

  1. step 01

    Crea una clave de API

    Regístrate y crea una clave en el panel ahora mismo, sin necesidad de tarjeta. La misma clave sirve para todos los modelos de reAPI, incluido Wan 3.0 en su lanzamiento.

    Abrir
  2. step 02

    Revisa la forma de la petición

    La documentación preliminar muestra la petición provisional de Wan 3.0: un prompt o una entrada de medios, un nivel de resolución y una duración de hasta 30 segundos. Los campos quedan cerrados cuando se abra la API del proveedor.

    Abrir
  3. step 03

    Sal a producción el día del lanzamiento

    Cuando Wan 3.0 se publique, el id del modelo, los parámetros y las tarifas por segundo quedarán fijados en esta página y el playground se activará. Las integraciones construidas sobre la forma preliminar necesitarán, como mucho, un retoque a nivel de campo.

    Abrir

Preguntas frecuentes

Dudas comunes sobre este modelo.

Wan 3.0 es el modelo de vídeo de nueva generación de Alibaba (Tongyi Wanxiang 3.0). Entró en beta pública el 6 de agosto de 2026 y se ha anunciado que genera hasta 30 segundos de vídeo en una sola pasada a partir de texto, imágenes, audio, vídeo y documentos, con control de referencia detallado sobre personajes, objetos de escena, voces, relaciones espaciales y estilo.

start building

¿Listo para lanzar?

Pruébalo en el playground o consigue una API key para integrarlo ahora.