
Características de Seedance 2.5: 30 segundos y 50 referencias
Características de Seedance 2.5: clips de 30 segundos continuos, 50 referencias multimodales, edición por regiones y por qué 4K es exclusivo de Seedance 2.0.
En la conferencia Volcano Engine FORCE celebrada en Pekín el 23 de junio de 2026, ByteDance mostró Seedance 2.5, la siguiente versión de su modelo de vídeo Doubao. Las características principales de Seedance 2.5 son un clip único continuo de 30 segundos generado directamente, compatibilidad con hasta 50 materiales de referencia multimodales en una generación, y edición a nivel de región[1].
Ese evento de junio fue una vista previa, no el lanzamiento. La situación ha cambiado desde entonces: a partir del 17 de agosto de 2026, Seedance 2.5 es invocable en reAPI como doubao-seedance-2.5-face, con salida 480p, 720p y 1080p y precios de producción publicados[3][4]. La guía de estado de lanzamiento de Seedance 2.5 rastrea la transición del anuncio al acceso de la API.
Las descripciones de características a continuación aún separan las afirmaciones de lanzamiento de ByteDance de los resultados medidos de forma independiente. La disponibilidad de la API hace que esas afirmaciones sean comprobables, pero no convierte una demostración del vendor en un punto de referencia independiente.
TL;DR
- Tres pilares anunciados: clips únicos de 30 segundos (hasta 15), hasta 50 referencias multimodales (hasta 12), y edición a nivel de región más visualización 3D[1].
- 4K nativo no es uno de ellos. El flujo de trabajo nativo 4K pertenece a la línea Seedance 2.0 anunciada en el mismo evento. Varios medios fusionaron los dos[1].
- El acceso de la API está activo en reAPI: usa el ID de modelo
doubao-seedance-2.5-face; la salida es 480p, 720p o (desde agosto de 2026) 1080p[3][4]. - El predecesor ya lidera. Seedance 2.0 se encuentra en el número 1 en la Arena de texto a vídeo de Artificial Analysis con un Elo de 1,219 entre modelos con audio[2].
- Los precios de reAPI se publican: $0.118589/s a 480p y $0.266824/s a 720p sin vídeo de origen; las tasas de vídeo de origen son $0.071153/s y $0.160094/s respectivamente[3].
Lo que ByteDance realmente anunció

| Capacidad | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Duración de clip único | 15 segundos | 30 segundos, generados directamente |
| Materiales de referencia | 9 imágenes + 3 vídeos + 3 clips de audio | 30 imágenes + 10 vídeos + 10 clips de audio |
| Control de edición | limitado | Edición a nivel de región + visualización 3D |
Según la presentación, el clip de 30 segundos se produce como una generación nativa única en lugar de varios clips cortos unidos en las costuras[1]. Los documentos del contrato reAPI en vivo documentan el techo de 50 referencias como 30 imágenes, 10 vídeos y 10 clips de audio[4].
Por qué 30 segundos es más difícil de lo que parece
Duplicar la duración máxima del clip de 15 a 30 segundos suena incremental. En generación de vídeo es uno de los problemas más difíciles.
La mayoría de los modelos mantienen la calidad durante unos segundos y luego se desplazan. Los personajes cambian sutilmente de aspecto, la iluminación cambia, el movimiento pierde plausibilidad física. El remedio común es generar varios clips cortos y unirlos, lo que introduce costuras visibles y errores de continuidad en cada unión[1].
Generar una toma coherente de 30 segundos directamente, si se mantiene fuera de las demostraciones curadas, elimina un impuesto de producción real. Para los formatos que ByteDance nombró en el escenario, previsualización de cine y televisión, publicidad y drama animado de corta duración, un medio minuto continuo es a menudo la diferencia entre una toma utilizable y un clip que necesita reparación manual.
La advertencia honesta: un clip único de 30 segundos es un techo. La calidad sostenida en toda esa ventana es exactamente lo que debe confirmar la prueba independiente.
Cincuenta referencias es la jugada de consistencia

El salto a 50 entradas de referencia es la actualización más relevante para el trabajo profesional. Una solicitud puede llevar hasta 30 imágenes, 10 vídeos y 10 clips de audio, aunque a menudo un conjunto más pequeño y claramente asignado es más fácil de controlar[4].
En la práctica, es una apuesta por la consistencia. Alimenta el modelo con tus rotaciones de personajes, tomas de productos, colores de marca y fotogramas de estilo, y tiene un fundamento mucho más sólido para mantener la misma cara, el mismo empaque y la misma apariencia en una secuencia.
Para un anunciante, la fidelidad de personaje y producto en todas las tomas es el trabajo completo. Un modelo que se desplaza en el logotipo es inutilizable sin importar lo cinemática que sea la moción.
Edición de región y visualización 3D
El tercer pilar es el control. ByteDance demostró edición a nivel de región: reemplazar un sujeto, fondo o producto dentro de una toma existente sin cambiar el movimiento original, movimiento de cámara o iluminación[1].
Eso importa para la iteración. En lugar de regenerar un clip completo y esperar que el resto sobreviva, intercambias un elemento y mantienes todo lo que ya está aprobado. Para localizar un producto en un mercado diferente o cambiar un modelo, esa edición dirigida es a menudo todo el trabajo.
La presentación también mostró visualización de modelo blanco 3D, permitiendo a los creadores bloquejar tomas y movimientos de cámara en una escena 3D aproximada antes de comprometerse con una generación completa[1]. Eso trae guiones gráficos y bloqueo de cámara al paso de generación en lugar de dejarlos a prueba y error.
La confusión de 4K que vale la pena aclarar
4K nativo, incluyendo 4K 10-bit, fue discutido en FORCE, pero pertenece a la línea Seedance 2.0, no a la diapositiva de titular 2.5, que lidera con duración, referencias y control de edición[1].
Varios medios plegaron 4K en la hoja de especificaciones 2.5. Los mantenemos separados porque eso es lo que muestran los materiales oficiales, y porque una especificación que se atribuye al modelo incorrecto es exactamente el tipo de error que sobrevive en las decisiones de compra. Nuestro trabajo anterior en lo que sabemos sobre Seedance 2.5 marcó la misma especificación 4K alegada por la prensa.
Dónde se encuentra la versión de envío
Este artículo no cita un punto de referencia independiente de Seedance 2.5. Para el contexto, la instantánea de julio a continuación registra dónde se encontraba Seedance 2.0 en un marcador de tablero de preferencias humanas de punto ciego neutral.

| Modelo | Elo de Arena de texto a vídeo |
|---|---|
| Seedance 2.0 (720p) | 1,219 |
| HappyHorse-1.0 | 1,124 |
| Kling 3.0 1080p Pro | 1,105 |
| Google Veo 3.1 | 1,094 |
Seedance 2.0 actualmente se encuentra en el número 1 entre modelos con audio, y también lidera el tablero de imagen a vídeo[2]. Un primer puesto en el marcador refleja la preferencia humana agregada en consultas muestreadas, no una victoria garantizada en cada resumen, y enfáticamente no un número 2.5.
Lo que sí te dice es que la línea de base sobre la que se construye 2.5 ya está en la vanguardia del campo, lo que aumenta la barra de lo que la actualización tiene que probar.
Contexto de precios
En reAPI, Seedance 2.5 cuesta $0.118589 por segundo a 480p y $0.266824 por segundo a 720p cuando no hay vídeo de origen adjunto. Una generación de 720p de 5 segundos por lo tanto reserva 1,335 créditos, o $1.335 después del redondeo de créditos[3].
Los trabajos de vídeo de origen usan tasas más bajas—$0.071153/s a 480p y $0.160094/s a 720p—pero se ejecutan en un reloj diferente. Los segundos facturables son el mayor de los segundos de salida más la duración total de vídeo de origen redondeada, u ceil(5 / 3 × segundos de salida)[4]. Compara la forma de solicitud completa en lugar de multiplicar la tasa descontada por la duración de salida solo.
A quién se dirigen las actualizaciones
Estas no son características para aficionados. Se dirigen a personas para quienes la consistencia y la iteración son el trabajo.
Los anunciantes y equipos de marca son el ajuste más claro. El techo de 50 referencias existe para que una campaña mantenga un producto, un logotipo y un portavoz en modelo en cada toma, y la edición de región convierte la localización de un anuncio en una edición dirigida en lugar de un reshooting.
Los equipos de previsualización obtienen bloqueo de modelo blanco 3D y tomas más largas, que mueven el guión gráfico al paso de generación.
Los estudios de animación de corta duración necesitan exactamente la coherencia de la narrativa de múltiples tomas que un clip de 30 segundos continuo permite.
Los mercadólogos de rendimiento que producen volumen se benefician si la postura de costos se mantiene, porque la economía de generar muchas variantes en marca cambia decisivamente.
Considera el caso concreto. Una marca de electrónica de consumo necesita el mismo comercial de héroe de 20 segundos en cuatro mercados. Con un modelo propenso a la deriva de clip corto que es cuatro generaciones casi desde cero más correcciones de continuidad manual. Con una pila de referencia que mantiene el producto fijo y la edición de región que solo cambia el talento y la copia de empaque, las versiones dos a través de cuatro se convierten en ediciones de la primera. Mismo movimiento, misma iluminación, mercado diferente.
Ese flujo de trabajo es por qué las actualizaciones aburridas, referencias y edición, pueden importar más que los 30 segundos titulares.
Qué probar ahora que está activo
Tres controles concretos importan porque las demostraciones de lanzamiento fueron curadas y el acceso de producción ahora hace posible la prueba repetible:
- ¿Se mantiene coherente el clip de 30 segundos de principio a fin, o aparece la deriva en el segundo 18 de la forma en que lo hace en modelos más cortos empujados más allá de su zona de confort?
- ¿50 referencias realmente se mantienen un personaje y una marca en tomas, o la referencia marginal deja de contribuir bien antes del techo?
- ¿La edición de región deja el resto del fotograma sin tocar, incluida la iluminación y el movimiento de la cámara?
Hasta que esos controles tengan resultados reproducibles, trata los techos de capacidad como especificaciones del vendor en lugar de garantías de calidad.
FAQ
¿Seedance 2.5 está disponible ahora?
Sí. En reAPI, el ID de modelo de producción invocable es doubao-seedance-2.5-face; admite salida 480p, 720p y 1080p[3][4].
¿Seedance 2.5 realmente genera vídeos de 30 segundos?
ByteDance especifica un clip único continuo de 30 segundos, el doble del techo de 15 segundos de Seedance 2.0[1]. La ruta reAPI en vivo hace que esa duración esté disponible para pruebas, pero la calidad de salida en toda la toma aún depende de la solicitud y referencias[4].
¿Seedance 2.5 admite 4K nativo?
No en la ruta reAPI actual. Seedance 2.5 admite 480p y 720p; usa Seedance 2.0 para 1080p o 4K[4].
¿Cómo se compara con Veo, Kling y Sora?
Este artículo no cita un punto de referencia independiente actual de Seedance 2.5. Su tabla de comparación registra la instantánea de marcador citada de Seedance 2.0 de julio, no una puntuación 2.5[2].
¿Cuántos materiales de referencia puede llevar Seedance 2.5?
Hasta 50 en reAPI: 30 imágenes, 10 vídeos y 10 clips de audio[4].
¿Qué más anunció ByteDance en FORCE?
Seedream 5.0 para imagen, Seed-Audio 1.0 para audio, y Doubao 2.1 Pro para texto, junto con cifras de plataforma incluyendo aproximadamente 180 billones de tokens procesados por día[1].
¿Puedo usar Seedance 2.5 a través de reAPI hoy?
Sí. Envía doubao-seedance-2.5-face al endpoint de generación de vídeo. La página de modelo activo publica ambos niveles de resolución y la documentación de la API cubre las reglas de solicitud y facturación[3][4].
Lectura clara del lanzamiento activo
Seedance 2.5 es un conjunto de afirmaciones confiadas del equipo cuyo modelo actual ya encabeza los arenas de vídeo independientes. Las actualizaciones que lidera son las correctas para la producción profesional, donde la consistencia y la iteración importan más que un clip cinemático.
La brecha entre una demostración de escenario pulida y un modelo manteniendo calidad en 30 segundos en tus solicitudes es exactamente lo que la API en vivo ahora puede revelar. Trata los límites publicados como restricciones, ejecuta la lista de pruebas anterior en metraje representativo, y elige Seedance 2.0 en su lugar cuando la salida 1080p o 4K importa más que el flujo de trabajo 2.5.
Referencias
- Volcano Engine. Seedance y la familia del modelo Doubao, anunciados en la conferencia FORCE. Recuperado en julio de 2026 de volcengine.com
- Artificial Analysis. Marcador de Arena de texto a vídeo. Recuperado en julio de 2026 de artificialanalysis.ai/text-to-video/arena
- reAPI. Seedance 2.5 — página de modelo activo y precios de producción. Recuperado el 17 de agosto de 2026 de reapi.ai/models/seedance-2-5
- reAPI. doubao-seedance-2.5-face — ID de modelo, resoluciones admitidas, esquema de solicitud y facturación de vídeo de origen. Recuperado el 17 de agosto de 2026 de reapi.ai/docs/seedance-2-5
Lecturas adicionales
- reAPI. Estado de lanzamiento de Seedance 2.5. reapi.ai/blog/seedance-2-5-release-status
- reAPI. Estado de Seedance 2.5: acceso de API, precios y límites. reapi.ai/blog/seedance-2-5-what-we-know-2026
- reAPI. Seedream 5.0 Pro y flujo de trabajo de Seedance 2.5. reapi.ai/blog/seedream-5-0-pro-seedance-2-5-workflow
Autor

Categorías
Más publicaciones

Usar ChatGPT sin sonar como IA: guía de redacción
Usa ChatGPT sin prosa genérica de IA. Convierte una tesis real, evidencia, redacción limitada y edición humana cuidadosa en escritura publicable.


Precio Seedream 5.0 Pro: la línea de píxeles que lo decide
Seedream 5.0 Pro divide precios en 2,36 millones de píxeles, no por etiqueta. Cómo dimensionar 16:9 para mantenerse en la tarifa más barata.


Cinco anuncios de producto con n8n por menos de $0.20
Construye un flujo de n8n para cinco anuncios de producto con un lote de $0.075 probado, sondeo limitado y lista de verificación de revisión.
