
Generar video con Opus 5.5: dirige tomas de Seedance 2.5
Opus 5.5 video hecho bien: Claude escribe planes, GPT Image 2.5 fija caracteres, Seedance 2.5 renderiza. Prompts, código y costos reales documentados.
La generación de video Opus 5.5 ahora aparece en YouTube y Brave autocomplete, y la frase oculta un malentendido. Claude Opus 5.5 no renderiza videos. Es un modelo de lenguaje con una ventana de contexto de 1 millón de tokens, servido a través de un endpoint de chat[1]. Lo que hace excepcionalmente bien es la parte que la mayoría de clips de IA hacen mal: decidir quién está en el marco, dónde se sienta la cámara, qué sucede segundo a segundo, y qué debe ser el audio.
El ejemplo público más claro es un desglose del 24 de septiembre en r/Seedance_AI. El autor dijo que "no escribió un solo prompt manualmente": Opus 5.5 convirtió un concepto y algunos screenshots de estilo en hojas de personajes, fotogramas iniciales, movimientos de cámara, sincronización de diálogos y sonido, y los píxeles vinieron de GPT Image 2.5 y Seedance 2.5[2]. Esta guía desglosa esa canalización, verifica cada paso contra la documentación de los propios proveedores, y muestra cómo ejecutar los tres modelos desde una clave de API.
Resumen
- Opus 5.5 planifica, no renderiza. En este flujo de trabajo escribe cada prompt; GPT Image 2.5 dibuja los fotogramas fijos y Seedance 2.5 hace el shot móvil y hablante[2].
- Describe al operador de cámara, no "realismo". El truco clave del desglose es decirle al modelo quién sostiene la cámara y dónde se sienta, lo que produce balanceo manual, búsqueda de enfoque automático y cambios de exposición[2].
- GPT Image 2.5 es el ancla de identidad. OpenAI dice que es "mejor en preservar los sujetos en tus fotos de referencia"[3], que es exactamente lo que necesita una hoja de personaje.
- Seedance 2.5 quiere estructura. La guía de ByteDance pide vinculaciones de activos numerados (Image 1, Image 2), marcas de tiempo sin espacios y controles negativos explícitos como "Sin subtítulos"[4].
- El costo es dominado por segundos de video. Dos shots Seedance 2.5 1080p de 10 segundos cuestan $9.24 en reAPI; los dos fotogramas fijos y la ejecución de planificación Opus 5.5 suman bien menos de un dólar[5][6][7].
Por qué la generación de video Opus 5.5 comienza con un guión
Los modelos de video recompensa la especificidad y castigan la ambigüedad. ByteDance lo dice directamente en su guía Seedance 2.5: la escritura de prompts "afecta principalmente la adherencia a instrucciones, la consistencia del material y la controlabilidad de generación," y no cambia los límites subyacentes del modelo[4]. La misma guía advierte que muy poca trama en un rango de tiempo permite que el modelo improvise, mientras que demasiado produce cortes excesivos o beats caídos[4].
Ese es un problema de escritura, y es donde un modelo de lenguaje fuerte gana su costo. Un solo shot Seedance 2.5 en el desglose de Reddit llega a más de 1.200 palabras: un bloque de referencia, un cierre de cámara, cuatro beats cronometrados con diálogos y claves de emoción, una sección de aspecto de película, una sección de audio y una lista de negativos[2]. Mantener todo eso consistente en varios shots a mano es tedioso. Pedirle a Opus 5.5 que sostenga la biblia de personajes en contexto y emita cada prompt no lo es.
El propio pitch de Anthropic para Opus 5.5 trata exactamente este tipo de disciplina. Dice que el modelo "pone la información más importante al frente" y "sigue las reglas de escritura que le das"[8]. Para generación de prompts, seguir tu plantilla cada vez importa más que flair.
Un comentarista en el desglose lo llamó usar un modelo de lenguaje para hacer el trabajo del modelo de video. Otro respondió el punto práctico: "estos prompts son masivos, y puede ser difícil sostenerlo todo y formatearlo correctamente en cada prompt"[2]. El mismo comentarista notó el costo de este enfoque: Claude tiende a agregar "un montón de basura" cuando le pides correcciones, así que edita la plantilla, no la salida.
La canalización de cuatro etapas, paso a paso
| Etapa | Modelo | Entrada | Salida |
|---|---|---|---|
| 1. Director | Claude Opus 5.5 | Un concepto, screenshots de estilo, tu plantilla de prompt | Biblia de personaje, prompts de imagen, prompts de video cronometrados |
| 2. Hoja de personaje | GPT Image 2.5 | Foto del sujeto + referencias de estilo + prompt de hoja | Un sheet 16:9: vuelta alrededor, expresiones, paneles de detalle |
| 3. Fotograma inicial | GPT Image 2.5 | Hoja de personaje + prompt de escena | El fotograma inicial exacto del shot |
| 4. Shot | Seedance 2.5 | Hoja de personaje + fotograma inicial + prompt cronometrado | Clip de 10 segundos con diálogos y sonido ambiental |
El prompt de hoja de personaje del desglose es una buena plantilla para copiar. Pide una fila de vuelta de seis ángulos y una fila de cinco expresiones más un panel de detalle, y establece "La identidad está bloqueada, sin deriva entre paneles," mientras marca las imágenes de estilo como "SOLO ESTILO"[2]. Esta separación importa: una referencia de estilo no etiquetada puede filtrar su persona en tu personaje.
El fotograma inicial es donde el look se hornea. El autor puso la calificación de cámara de punto y disparo de principios de los años 2000 directamente en el prompt de imagen: "película de 35 mm, lente angular de 28 mm con leve distorsión de barril," "negros elevados," "grano de película fino visible"[2]. Seedance 2.5 luego trata ese fotograma como la referencia maestra para ubicación, luz y calificación.
Para las etapas 2 y 3, GPT Image 2.5 viene en dos versiones. OpenAI posiciona Flare como "la opción predeterminada para la mayoría de aplicaciones" y Sunburst para "flujos de trabajo visuales premium que se benefician del control más ajustado en ediciones"[3]. Una hoja de personaje que reutilizarás para cada shot es un lugar razonable para gastar los $0.002 adicionales por imagen en Sunburst.
El truco del operador de cámara y lo que agrega la guía Seedance
El detalle que los comentaristas destacaron fue el segundo punto del autor: no pidas un "video realista." Di quién sostiene la cámara, dónde se sienta y cómo se mueve[2]. El autor informa que una línea, "mi amigo está filmando desde el asiento trasero," fue suficiente para que Opus 5.5 escribiera sacudidas micro, encuadre retrasado, búsqueda de enfoque automático y cambios de exposición en el prompt.
Esto funciona porque Seedance 2.5 entiende el lenguaje de cámara simple. ByteDance enumera tamaños de shot, movimientos como "push in," "orbit," y "handheld shake," ángulos como "first-person perspective," y técnicas como tomas largas de una toma como términos que puedes escribir directamente[4]. Un operador de cámara con una ubicación y un cuerpo le da al modelo una razón para usarlos consistentemente.
Cinco reglas más de la guía oficial pertenecen a la plantilla que le das a Opus 5.5:
- Numera y vincula cada activo. Refiere cargas como Image 1, Image 2 en orden de carga, y establece cada vinculación en el texto. ByteDance advierte contra depender de etiquetas dibujadas dentro de la imagen[4].
- Mantén marcas de tiempo continuas. Escribe "0-3 segundos... 3-7 segundos..." y evita espacios; no uses marcas de tiempo para acciones rápidas repetidas como "agita tu cabeza tres veces por segundo"[4].
- Di lo que no quieres en el audio. "Sin BGM; genera solo sonidos ambientales y de acción" y "Sin subtítulos" son ambos negativos soportados[4].
- Pon líneas habladas entre comillas dobles. Las notas de referencia Seedance 2.5 de reAPI señalan que las líneas entrecomilladas dirigen el habla generada[9].
- Presupuesta la trama por rango de tiempo. Cada etapa debe mantener un evento claro y un estado final[4].
ByteDance también publica una skill oficial de optimización de prompts Seedance 2.5. Su guía recomienda instalarla con npx --yes skills@latest add "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" --skill sd25-pe --yes, luego escribir /sd25-pe seguido de tu prompt en una caja de chat de IA[4]. Opus 5.5 puede redactar el shot, y la skill puede verificarlo contra las convenciones propias de ByteDance.
Un prompt de director para Opus 5.5
Cada ejecución de generación de video Opus 5.5 comienza desde el mismo bloque de instrucciones. Esta es una plantilla inicial, no una transcripción de la sesión del autor de Reddit. Reemplaza las partes entre corchetes.
You are the director and prompt writer for a short live-action AI video.
Concept: [one paragraph]
Style references: Image 2 and Image 3 are STYLE ONLY (grade, lens, grain).
Subject: Image 1 is the person. Identity must never drift.
Camera operator: [who films, where they sit, what device, how they move].
Produce, in order:
1. A character bible: face, hair, wardrobe, jewelry, props. Fixed wording.
2. A GPT Image 2.5 prompt for a 16:9 character sheet (turnaround,
five expressions, detail panels, "Identity is locked").
3. A GPT Image 2.5 prompt for the start frame of shot 1.
4. A Seedance 2.5 prompt per shot, 10 seconds each, with:
- Asset bindings: "Image 1 = identity, Image 2 = start frame"
- A camera section written from the operator's point of view
- Continuous timestamps (0-3s, 3-5s, 5-8.5s, 8.5-10s), one event each
- Dialogue in double quotes, with emotion cues per phrase
- Audio: on-camera mic only, list ambient sounds, "No BGM" if needed
- Negatives: "No subtitles", no cuts unless requested, no morphing
Reuse the character bible wording verbatim in every prompt.La última línea es la que detiene la deriva. Si cada prompt describe el collar ligeramente diferente, también lo hará el modelo de video.
Ejecutar Opus 5.5, GPT Image 2.5 y Seedance 2.5 desde una clave
Los tres modelos se sientan detrás de la misma clave reAPI. Opus 5.5 usa el endpoint de chat completions con ID de modelo claude-opus-5-5[1]. GPT Image 2.5 y Seedance 2.5 son asincrónicas: presentas, recibes una ID de tarea, e interrogas GET /api/v1/tasks/{id} hasta que el estado sea completed[9][10].
import time, requests
BASE = "https://reapi.ai/api/v1"
H = {"Authorization": "Bearer YOUR_API_KEY"}
def wait(task_id):
while True:
t = requests.get(f"{BASE}/tasks/{task_id}", headers=H).json()
if t["status"] in ("completed", "failed"):
return t
time.sleep(10)
# 1. Opus 5.5 writes the prompts (DIRECTOR_PROMPT = the template above)
plan = requests.post(f"{BASE}/chat/completions", headers=H, json={
"model": "claude-opus-5-5",
"messages": [{"role": "user", "content": DIRECTOR_PROMPT}],
"reasoning_effort": "high",
"max_tokens": 16000,
}).json()["choices"][0]["message"]["content"]
# parse SHEET_PROMPT, FRAME_PROMPT, SHOT_PROMPT out of `plan`
# 2. Character sheet from the subject photo and style references
sheet = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
"model": "gpt-image-2.5-sunburst",
"prompt": SHEET_PROMPT,
"image_urls": [SUBJECT_URL, STYLE_URL_1, STYLE_URL_2],
}).json()["id"])["output"]["image_urls"][0]
# 3. Start frame, anchored to the sheet
frame = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
"model": "gpt-image-2.5-sunburst",
"prompt": FRAME_PROMPT,
"image_urls": [sheet],
}).json()["id"])["output"]["image_urls"][0]
# 4. The 10-second shot. Image 1 = sheet, Image 2 = start frame
shot = wait(requests.post(f"{BASE}/videos/generations", headers=H, json={
"model": "doubao-seedance-2.5-face",
"prompt": SHOT_PROMPT,
"image_urls": [sheet, frame],
"duration": 10,
"resolution": "1080p",
"size": "16:9",
}).json()["id"])["output"]["video_urls"][0]
print(shot)Tres detalles de la documentación de referencia valen la pena saber antes de ejecutarlo. Cada campo de medios debe ser una URL HTTP(S) pública; base64 y URIs data: son rechazados[9]. Seedance 2.5 acepta hasta 30 imágenes de referencia, por lo que una hoja, un fotograma inicial y algunos shots de accesorios caben fácilmente[9]. Y Opus 5.5 siempre piensa adaptativamente; reasoning_effort cambia qué tan profundo, y el predeterminado nativo es medio[1].
Lo que cuesta una ejecución de generación de video Opus 5.5
Los precios a continuación son las tarifas publicadas de reAPI el 29 de septiembre de 2026[5][6][7]. La línea Opus 5.5 asume una sesión de planificación de 30.000 tokens de entrada y 10.000 tokens de salida. Esa cifra es una ilustración, no una medición; tu longitud de plantilla y nivel de esfuerzo la mueven.
| Artículo | Tarifa | Cantidad | Costo |
|---|---|---|---|
| Entrada Opus 5.5 | $3.20 por 1M tokens | 30.000 | $0.096 |
| Salida Opus 5.5 | $16.00 por 1M tokens | 10.000 | $0.160 |
| GPT Image 2.5 Sunburst | $0.025 por imagen | 2 | $0.05 |
| Seedance 2.5, 1080p | $0.462 por segundo | 20 s | $9.24 |
| Total | alrededor de $9.55 |
Los segundos de video son más del 96% de la factura. Los apalancamientos que importan están todos en el lado de Seedance: 720p corre $0.267 por segundo ($5.34 para los mismos 20 segundos), y el tier Eco de Seedance 2.5 factura 1080p en $0.347 por segundo ($6.94) con el mismo cuerpo de solicitud[7][9]. Una rutina sensata es iterar en 720p hasta que el desempeño y la cámara sean correctos, luego renderizar el guardián en 1080p.
Para comparación, Anthropic enumera Opus 5.5 en $4 entrada y $20 salida por millón de tokens, y dice que cuesta aproximadamente 40% menos que Opus 5 en cargas de trabajo típicas[8]. De cualquier forma, el director es la parte barata.
FAQ
¿Puede Claude Opus 5.5 generar videos por sí solo?
No. Opus 5.5 es un modelo de lenguaje llamado a través de chat completions; devuelve texto[1]. En un flujo de trabajo de generación de video Opus 5.5 escribe los prompts, y un modelo de video como Seedance 2.5 renderiza el clip.
¿Qué es la skill Seedance 2.5?
Es la skill oficial de optimización de prompts de ByteDance para Seedance 2.5, llamada sd25-pe. La guía BytePlus la instala con npx skills e la invoca escribiendo /sd25-pe más tu prompt en una caja de chat de IA[4].
¿Cuánto tiempo puede durar un video Seedance 2.5?
Hasta 30 segundos por generación. En reAPI, duration acepta 4 a 30 segundos, o -1 para dejar que el modelo elija[9]. El flujo de trabajo de Reddit usó shots de 10 segundos y los cortó juntos[2].
¿Cuánto cuesta un clip Opus 5.5 y Seedance 2.5?
Aproximadamente $9.55 por dos shots 1080p de 10 segundos, dos stills Sunburst de GPT Image 2.5 y una sesión de planificación en los conteos de tokens asumidos anteriormente. Renderizar en 720p trae la misma ejecución a aproximadamente $5.65[5][6][7].
¿Debo usar GPT Image 2.5 Flare o Sunburst para la hoja de personaje?
Sunburst, si la hoja anclará varios shots. OpenAI la describe como ofreciendo "control más ajustado en ediciones"; Flare es el predeterminado más rápido[3]. En reAPI la diferencia es $0.023 versus $0.025 por imagen[6].
¿Necesito Claude Code para este flujo de trabajo?
No. El guión anterior llama a Opus 5.5 sobre HTTP simple. Anthropic ofrece Opus 5.5 en Claude Code, incluyendo un modo rápido[8], y ese es un lugar cómodo para iterar en una plantilla o ejecutar la skill sd25-pe. La canalización de producción solo necesita una clave de API.
¿Puede Opus 5.5 planificar un videoclip musical?
Puede escribir la lista de shots, timing y dirección de sonido. Seedance 2.5 genera habla, efectos de sonido y música de fondo con el clip, y también acepta audio de referencia (hasta 10 tracks, 30 segundos combinados), por lo que una canción puede impulsar la edición[9].
Trata Opus 5.5 como el director y Seedance 2.5 como la tripulación
El flujo de trabajo que circuló r/Seedance_AI tiene éxito por una razón aburrida: cada prompt es largo, específico y consistente, y un modelo de lenguaje es mejor que un humano cansado en producir eso. Dale a Opus 5.5 una plantilla fija, una biblia de personaje que debe reutilizar palabra por palabra, y un operador de cámara con un asiento y un dispositivo. Deja que GPT Image 2.5 bloquee la cara, y gasta tu presupuesto de iteración en segundos Seedance 2.5 en 720p antes del render 1080p final. Esa es la generación de video Opus 5.5 que realmente se envía: un modelo para pensar, dos para renderizar, y una clave de API para los tres en reAPI.
References
- reAPI. Claude Opus 5.5 API: model ID, parameters and pricing. Retrieved September 2026 from reapi.ai/docs/claude-opus-5-5
- r/Seedance_AI. Full Breakdown: How I used Claude Opus & Seedance 2.5 to achieve photorealistic AI videos (All Prompts Included). Posted September 24, 2026. Retrieved September 2026 from reddit.com/r/Seedance_AI/comments/1wop0ju
- OpenAI. Introducing ChatGPT Images 2.5. September 8, 2026. Retrieved September 2026 from openai.com/index/introducing-chatgpt-images-2-5
- BytePlus ModelArk. Dreamina Seedance 2.5 prompt guide. Retrieved September 2026 from docs.byteplus.com/en/docs/modelark/seedance-2-5-prompt-guide
- reAPI. Claude Opus 5.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/claude-opus-5-5
- reAPI. GPT Image 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/gpt-image-2-5
- reAPI. Seedance 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/seedance-2-5
- Anthropic. Introducing Claude Opus 5.5. Retrieved September 2026 from anthropic.com/claude-opus-5-5
- reAPI. Seedance 2.5 API: parameters, modes and billing. Retrieved September 2026 from reapi.ai/docs/seedance-2-5
- reAPI. GPT Image 2.5 API reference. Retrieved September 2026 from reapi.ai/docs/gpt-image-2-5
Autor

Categorías
Más publicaciones

Dónde usar Seedance 2.5: apps oficiales y acceso API
Descubre dónde usar Seedance 2.5 con apps oficiales, BytePlus, Volcengine, reAPI e Higgsfield: requisitos de cuenta y límites regionales hoy.


Atlas Cloud vs Higgsfield: plataforma API o estudio
Compara Atlas Cloud, Higgsfield y reAPI para Seedance: acceso API, flujos de trabajo, precios, variedad de modelos y cuál opción se ajusta a tu equipo.


API de eliminación de fondo: el coste real por imagen útil
Calcula el precio desde 88 créditos en vivo, luego suma rechazos, reintentos, almacenamiento y revisión para conocer el coste real de cada imagen válida.
