
API Wan 3.0 Video Prime: precios, modos y configuración Python
Usa Wan 3.0 Video Prime para generar vídeos de 2–30 segundos. Precios, cinco modos de solicitud, código Python, límites y trampas de facturación.
Wan 3.0 Video Prime es la ruta de alto rendimiento de Wan 3.0 en reAPI. Genera vídeos de 2 a 30 segundos a partir de texto, fotogramas iniciales y finales, medios de referencia mixtos, un documento o una página web pública. El ID del modelo es
wan3.0-video-prime y los trabajos se ejecutan de forma asincrónica a través del punto final de vídeo estándar de reAPI.[1]
Prime cuesta más que el Wan 3.0 estándar, así que tiene sentido cuando el tiempo de espera importa al producto, no simplemente porque «Prime» suene mejor. No hay garantía de latencia fija publicada y el tiempo de finalización real sigue variando según la duración, resolución, entradas y carga del servicio.
TL;DR
- Punto final:
POST https://reapi.ai/api/v1/videos/generations - Modelo:
wan3.0-video-prime - Salida: 2 a 30 segundos a 480P, 720P o 1080P
- Entradas: texto, uno o dos fotogramas, imágenes/vídeos/audio de referencia, un documento o una página web pública
- Audio: incluido por defecto; desactivarlo no reduce la tarifa
- Tarifas de reAPI actuales: $0,068/s a 480P, $0,139/s a 720P y $0,278/s a 1080P
- Trampa de facturación: la resolución omitida por defecto es 1080P, mientras que
duration: -1reserva el tope de 30 segundos
Precios de la API Wan 3.0 Video Prime
reAPI factura Prime por duración de salida y resolución. El tipo de entrada no cambia la tarifa por segundo, por lo que un vídeo de diez segundos basado en documentos cuesta lo mismo que un trabajo de texto a vídeo de diez segundos a la misma resolución.[1]
| Resolución | Tarifa actual | 5 segundos | 10 segundos | 30 segundos |
|---|---|---|---|---|
| 480P | $0,068/s | $0,34 | $0,68 | $2,04 |
| 720P | $0,139/s | $0,70 | $1,39 | $4,17 |
| 1080P | $0,278/s | $1,39 | $2,78 | $8,34 |
Estas son tarifas de puerta de enlace de reAPI al 26 de agosto de 2026, no un anuncio de que Alibaba redujo sus propios precios. Consulta la página del modelo Wan 3.0 Video Prime en vivo antes de poner una tarifa en una calculadora cara al cliente.
Para exploración, 480P mantiene los reintentos económicos. Pasa un indicador a 720P o 1080P solo después de que el movimiento, el tiempo y el comportamiento de referencia sean aceptables. Una resolución más alta no puede reparar un mal movimiento de cámara o un resumen sobrecargado.

Cinco modos comparten un ID de modelo
Prime no tiene un parámetro mode. Los campos de la solicitud determinan qué flujo se ejecuta.
| Flujo de trabajo | Campos a enviar | Restricción principal |
|---|---|---|
| Texto a vídeo | prompt | Indicación requerida |
| Fotograma inicial | first_frame_url | URL de imagen pública |
| Fotograma inicial + final | first_frame_url, last_frame_url | Los fotogramas se ordenan explícitamente |
| Vídeo de referencia | reference_image_urls, reference_video_urls y/o reference_audio_urls | Al menos una referencia más una indicación |
| Documento o página web | reference_file_urls o reference_link_urls | Elige uno; no los combines |
Los campos de fotograma no se pueden mezclar con reference_*_urls. Una solicitud que contenga tanto un fotograma inicial como imágenes de referencia es ambigua y será rechazada.
Todos los activos también deben ser accesibles a través de una URL HTTP(S) pública; no se aceptan URI en base64 y data:.[1]
Los límites de referencia son generosos pero finitos: hasta diez imágenes, cinco clips de vídeo y cinco clips de audio. Los vídeos de referencia no pueden sumar más de 15 segundos, y su duración combinada más la salida solicitada debe mantenerse dentro de 30 segundos. Un vídeo de referencia de 12 segundos deja, por lo tanto, un máximo de 18 segundos para el clip generado.
Una solicitud Python que funciona
La llamada inicial más segura establece duración, resolución, relación de aspecto y audio explícitamente. Eso mantiene la factura predecible y facilita la reproducción de la solicitud.
import time
import requests
API_KEY = "YOUR_API_KEY"
BASE_URL = "https://reapi.ai/api/v1"
HEADERS = {
"Authorization": f"Bearer {API_KEY}",
"Content-Type": "application/json",
}
payload = {
"model": "wan3.0-video-prime",
"prompt": (
"One continuous shot of a lighthouse keeper climbing a spiral "
"staircase at dawn. The camera follows two steps behind. Warm "
"window light crosses the walls; distant gulls and quiet surf."
),
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 10,
"audio": True,
}
response = requests.post(
f"{BASE_URL}/videos/generations",
headers=HEADERS,
json=payload,
timeout=30,
)
response.raise_for_status()
task_id = response.json()["id"]
deadline = time.time() + 600
while time.time() < deadline:
status_response = requests.get(
f"{BASE_URL}/tasks/{task_id}",
headers=HEADERS,
timeout=30,
)
status_response.raise_for_status()
task = status_response.json()
if task["status"] == "completed":
print(task["output"]["video_urls"][0])
print("credits used:", task["usage"]["credits"])
break
if task["status"] == "failed":
raise RuntimeError(task.get("error") or "Generation failed")
time.sleep(6)
else:
raise TimeoutError(f"Task {task_id} is still processing")Guarda el ID de tarea antes de realizar encuestas. Si el proceso del cliente se reinicia, ese ID es suficiente para reanudar las comprobaciones de estado sin pagar por otra generación. Una tarea fallida se reembolsa automáticamente, pero un envío duplicado impaciente crea un segundo trabajo facturable si ambos tienen éxito.[1]
Fotogramas iniciales y finales frente a imágenes de referencia
Usa el modo de fotograma cuando la composición de apertura o cierre sea innegociable. Una imagen fija el fotograma inicial; dos imágenes definen los fotogramas inicial y final en ese orden. La indicación debe describir el movimiento entre ellos en lugar de replantear cada objeto visible.
Usa el modo de referencia cuando una imagen proporcione identidad, vestuario, forma de producto o lenguaje visual sin servir como fotograma de límite exacto. Nombra los activos por su posición dentro de cada matriz:
{
"model": "wan3.0-video-prime",
"prompt": "Keep Image1 as the performer and Image2 as the coat. Use the walking pace from Video1 and the room tone from Audio1.",
"reference_image_urls": [
"https://cdn.example.com/performer.jpg",
"https://cdn.example.com/coat.jpg"
],
"reference_video_urls": [
"https://cdn.example.com/walk.mov"
],
"reference_audio_urls": [
"https://cdn.example.com/room-tone.wav"
],
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 12
}Las referencias guían la generación; no garantizan la preservación exacta de píxeles. Cuando un logotipo, etiqueta de producto o línea de texto debe sobrevivir sin cambios, revisa la representación como un activo de producción en lugar de asumir que la entrada se copiará textualmente.
Los dos valores por defecto más probables de desperdiciar presupuesto
El primero es la resolución. Prime utiliza 1080P de forma predeterminada, el nivel más caro. Un trabajo de exploración de diez segundos cuesta $2,78 a 1080P frente a $0,68 a 480P. Siempre envía el campo en lugar de confiar en el valor por defecto.
El segundo es la duración inteligente. Pasar -1 permite que el modelo elija la longitud de salida, pero reAPI reserva el costo máximo de 30 segundos porque la longitud final es desconocida al envío. La duración inteligente es útil cuando el ritmo importa más que un presupuesto fijo. Para una cola con límites de gastos estrictos, envía un número entero entre 2 y 30.
Preguntas frecuentes
¿Es Wan 3.0 Video Prime un ID de modelo diferente de Wan 3.0?
Sí. Prime utiliza wan3.0-video-prime; el Wan 3.0 estándar utiliza wan3.0-video.
Sus esquemas de solicitud de reAPI también utilizan nombres de campo diferentes, por lo que cambiar solo la cadena de modelo no es una migración segura.
¿Prime produce mejor calidad de vídeo?
La documentación de reAPI publicada no afirma una ventaja de calidad. Prime se posiciona en torno a un tiempo de respuesta más rápido. Compara trabajos representativos antes de pagar la prima de velocidad para una cola de producción.
¿Puede Prime generar un vídeo de 30 segundos con audio?
Sí. Admite salida de 2 a 30 segundos y audio por defecto es true. El sonido generado aún necesita revisión de precisión de diálogos, música no deseada, recorte y continuidad.
¿Puedo cargar un PDF directamente en el cuerpo JSON?
No. Cárgalo en una URL HTTP(S) pública y luego pasa una matriz reference_file_urls de un solo elemento. Los documentos pueden tener hasta 100 MB y 50 páginas.
¿Cómo debo elegir entre Prime y el Wan 3.0 estándar?
Utiliza el tiempo de respuesta medido y el costo de reintento de tu propia carga de trabajo. La dedicada comparación de Wan 3.0 Video Prime vs Wan 3.0 explica la brecha de precios actual y los detalles de la migración.
Conclusión
La API Wan 3.0 Video Prime es útil cuando un flujo de trabajo orientado al usuario o sensible al tiempo puede justificar una tarifa por segundo más alta. Establece resolución y duración explícitamente, elige una familia de medios, guarda el ID de tarea y mide el tiempo real de la cola antes de enrutar cada trabajo a Prime. La referencia de campo completa está en la documentación de Prime API.
Referencias
- reAPI. Wan 3.0 Video Prime API documentation and live model rate card. Consultado el 26 de agosto de 2026 desde reapi.ai/docs/wan-3-0-video-prime y reapi.ai/models/wan-3-0-video-prime
- Alibaba Cloud. Wan 3.0: 30-Second AI Video Generation from Any Input. Consultado el 26 de agosto de 2026 desde alibabacloud.com/blog/wan3-0-30-second-ai-video-generation-from-any-input_603452
Lecturas adicionales
Autor

Categorías
Más publicaciones

Upscaling de vídeo con IA en 2026: gratuito, escritorio y API
Guía completa de upscaling de vídeo con IA en 2026: herramientas de código abierto gratis, Topaz a $59/mes, APIs desde $0.002/s con código Python.


¿Es Wan 3.0 código abierto? Pesos, API y uso local
Wan 3.0 está disponible por API pero sin pesos oficiales desde agosto de 2026. Qué está disponible, qué no, y cuándo Wan 2.2 es la mejor opción local.


Coherencia de personajes en Seedance 2.0: guía oficial
El método oficial para mantener al mismo personaje: sintaxis de referencias, 12 entradas, voz, sincronización labial y prompts con varios planos.
