Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 por segundo
Generador de Video AI Con Gente Real: Qué Funciona de Verdad
2026/08/09

Generador de Video AI Con Gente Real: Qué Funciona de Verdad

Un generador de video AI con gente real: referencias consentidas funcionan, sintéticos fotorrealistas dan falsos positivos, celebridades rechazadas siempre.

Busca un generador de video AI con gente real y el autocompletado te muestra lo que todos preguntan realmente: with people talking, with famous people, real person, free. Son cuatro preguntas distintas con cuatro respuestas diferentes, y exactamente una de ellas es rechazada en todas partes sin importar qué plataforma pagues.

La división útil no es por herramienta. Es por quién es el rostro. Una fotografía de un sujeto que consintió, un carácter sintético que casualmente se ve fotorrealista, y una celebridad nombrada son tres cosas legalmente y técnicamente distintas, y la mayor parte de la frustración en este espacio viene de plataformas tratando las tres como una sola categoría bloqueada. Esto recorre qué hace cada una en realidad en una API de video moderna, qué requiere el habla en la parte superior, y dónde la línea genuinamente no se mueve.

TL;DR

  • Las fotos de referencia y clips de gente real son soportados. El parámetro de referencia de Seedance 2.5 establece claramente que "las imágenes/videos de referencia pueden contener gente real."[1]
  • El material de referencia rechazado se reembolsa completamente. El material pasa la revisión automatizada antes de la generación, y cualquier cosa rechazada falla con un error y un reembolso completo de la reserva.[2]
  • Hablar es una capacidad separada. Seedance 2.5 genera "discurso sincronizado, efectos de sonido y música de fondo" con generate_audio, activado por defecto.[1] Kling 3.0 documenta la sincronización de labios explícitamente.[3]
  • Las celebridades nombradas son rechazadas en todas las rutas. Esa es la propia línea del modelo, no una configuración de política de plataforma, y ningún parámetro la alcanza.
  • El consentimiento sigue siendo tuyo para obtener. Una API que acepta una carga no ha adquirido permiso en tu nombre.

Cuatro preguntas distintas usando un término de búsqueda

Tu propio metraje, o un sujeto que consintió. Este es el caso legítimo más grande: fundadores en sus propias demostraciones de productos, creadores de UGC, actores que firmaron un lanzamiento, un cliente cuyo video de marca estás haciendo. Es soportado, y el resto de este artículo trata principalmente sobre eso.

Una persona sintética que se ve fotorrealista. Tu personaje no existe, pero tu generador de imágenes se volvió lo suficientemente bueno que los clasificadores de rostros lo califican como una fotografía. Este es el caso que genera la mayoría de las quejas, porque el rechazo es un falso positivo en lugar de una política.

Una figura pública nombrada. Rechazada. No por reAPI como un asunto de política, sino por el modelo, en todos los anfitriones que lo revenden. Cualquier plataforma que anuncie lo contrario está equivocada o te está vendiendo un problema de derechos de similitud.

Gente hablando. Una pregunta de capacidad en lugar de una pregunta de permiso, y se responde por qué modelo eliges en lugar de qué plataforma.

Confundir estos es por qué el consejo que encuentras en línea es contradictorio. Alguien cuyo flujo de trabajo de sujeto consentido funciona bien y alguien cuyo personaje sintético sigue rebotando están reportando con precisión sobre preguntas diferentes.

Usando una persona consentida como referencia

La ruta soportada es material de referencia, no indicar una descripción. Seedance 2.5 toma hasta 30 imágenes de referencia, 10 clips de referencia y 10 pistas de audio en una generación.[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

Las restricciones que vale la pena conocer antes de que armes un conjunto de referencia:[1]

CampoLímiteFormatos
image_urlshasta 30, cada uno menos de 30 MBjpeg, png, webp, bmp, tiff, gif, heic, heif
video_urlshasta 10, cada uno 2–30 s, menos de 200 MB, combinados 30 smp4, mov, 480p a 4K
audio_urlshasta 10, cada uno 2–30 s, menos de 15 MBwav, mp3

Dos reglas atrapan a la gente. Cada referencia debe ser una URL HTTP(S) pública; los payloads base64 y data: se rechazan en toda la plataforma, no solo en este modelo.[1] Y image_urls no se puede combinar con image_with_roles, así que las referencias de personaje y el encadenamiento de primer/último fotograma son modos separados.[1]

El material de referencia pasa a través de una revisión automatizada antes de que se ejecute la generación. Si es rechazado, la tarea falla con un error y la reserva se reembolsa completamente,[2] lo que significa que un falso positivo te cuesta un reintento en lugar de dinero.

Hacerles hablar

Aquí es donde la elección del modelo importa más que la elección de la plataforma, y las dos opciones documentadas se comportan de manera diferente.

Seedance 2.5 genera audio de forma nativa. generate_audio tiene como valor predeterminado true y produce "discurso sincronizado, efectos de sonido y música de fondo (mono)."[1] El discurso se genera con el video en lugar de ser doblado sobre él, así que el movimiento de la boca y el audio provienen del mismo pase. Lo diriges a través del prompt.

Kling 3.0 documenta la capacidad más específicamente, describiendo audio nativo sincronizado como "diálogo, sincronización de labios, sonido ambiente."[3] Si la precisión de la sincronización de labios en el diálogo es lo que se está juzgando, esa es la reclamación explícita para poner a prueba.

Lo que ninguno ofrece es un modo de doblaje donde proporcionas una pista de voz terminada y obtienes coincidencia de forma de boca precisa con ella. audio_urls de Seedance 2.5 se documentan como pistas de audio de referencia,[1] que es un trabajo diferente de la conducción de sincronización de labios. Si tu pipeline ya tiene VO grabado, prueba esa suposición en un clip corto antes de construir alrededor de ella.

Una nota práctica para el trabajo de cabeza parlante: el audio no sobrevive a la segmentación. Cada generación sintetiza su propia pista, así que una secuencia ensamblada a partir de varios clips te da varios lechos de audio independientes. Para el diálogo más largo que una generación, graba o sintetiza la voz por separado y trata el video como solo imagen.

La línea que no se mueve

La gente viva nombrada es rechazada. Cada ruta honesta lo hace cumplir, y se queda con el modelo en lugar de con la configuración de cualquier plataforma. Si un anfitrión afirma lo contrario, la respuesta correcta es sospecha, no un registro.

Los personajes de terceros también son rechazados. La misma verificación atrapa personajes con copyright reconocibles, que es una frustración recurrente para anime y trabajo de fans y no tiene solución que valga la pena publicar.

El consentimiento no se transfiere mediante un formulario de carga. La API que acepta tu foto de referencia no es permiso de la persona en ella. Lanzamientos, derechos de similitud y, en varias jurisdicciones, reglas de datos biométricos son tu responsabilidad y no se convierten en la de la plataforma porque una solicitud devolvió 200.

Ese último no es un boilerplate legal. Es la razón por la que existe la ruta soportada: la verificación está diseñada para detener el caso no consensuado, y funciona mejor cuando el caso legítimo tiene un lugar adonde ir.

Cuando una persona que no existe es rechazada

La falla más común en este espacio es que un personaje completamente sintético sea bloqueado como una persona real, porque el clasificador califica el fotorrealismo en lugar de la procedencia. No tiene forma de saber que tu personaje fue generado. Los usuarios han reportado la misma clase de rechazo con errores como "Input image may contain real person" en otras plataformas.[4]

La mecánica, las cadenas de error exactas, y cómo diferenciar un detector de rostro a nivel de plataforma de una verificación a nivel de modelo se cubren en reapi.ai/blog/seedance-face-detected-real-person-error. La versión corta: mide el tiempo del rechazo. Un rechazo que ocurra en menos de un segundo nunca llegó a una GPU.

Lo que cuesta

El trabajo impulsado por referencias se cotiza igual que cualquier otra generación en Seedance 2.5, con un giro. Las imágenes y audio de referencia no cambian la tarifa; un video de referencia te mueve a una tarifa por segundo más baja que se factura sobre segundos de entrada más salida.[2]

Trabajo, 720pCosto
8 s desde imágenes de referencia$2.13
30 s desde imágenes de referencia$8.01
Clip de referencia de 10 s a salida de 5 s$2.40

Tarifas de la banda por segundo publicada.[2] Una verificación de moderación fallida se reembolsa completamente, así que los conjuntos de referencia exploratorios cuestan tiempo en lugar de créditos.

FAQ

¿Puedo usar un generador de video AI con gente real en absoluto?

Sí, con material de referencia de un sujeto que consintió. El parámetro de referencia de Seedance 2.5 establece que las imágenes y videos de referencia pueden contener gente real.[1]

¿Puedo generar una persona famosa?

No. Las figuras públicas nombradas se rechazan a nivel de modelo en todas las rutas, y ningún parámetro cambia eso.

¿Qué modelo maneja gente hablando?

Seedance 2.5 genera discurso sincronizado junto con el video con generate_audio.[1] Kling 3.0 documenta diálogo y sincronización de labios explícitamente.[3]

¿Puedo suministrar mi propia grabación de voz y obtener sincronización de labios con ella?

No como un modo documentado. audio_urls de Seedance 2.5 son pistas de referencia en lugar de un conductor de sincronización de labios.[1] Pruébalo en un clip corto antes de diseñar un pipeline alrededor de ello.

¿Por qué mi personaje generado por AI fue rechazado como una persona real?

Porque la verificación califica el fotorrealismo, no el origen. Consulta la explicación de detección de rostros para identificar qué capa te rechazó.

¿Me cobran cuando una referencia es rechazada?

No en reAPI. Una tarea que falla la revisión reembolsa la reserva completamente.[2]

¿Puedo cargar el archivo de referencia directamente?

No. Cada referencia debe ser una URL HTTP(S) pública. Los payloads Base64 y data: se rechazan en toda la plataforma.[1]

¿Cuántas imágenes de referencia puede tomar una generación?

Hasta 30, más 10 clips y 10 pistas de audio.[1]

Trabajar con rostros en lugar de alrededor de ellos

Decide cuál de las cuatro preguntas realmente tienes antes de elegir una herramienta, porque tres de ellas son decisiones ordinarias de producto y una de ellas no está disponible en ningún lugar. Un sujeto que consintió y un buen conjunto de referencias es un flujo de trabajo soportado con una superficie de parámetros publicada y un reembolso cuando la revisión dice que no. Un personaje sintético fotorrealista es el mismo flujo de trabajo más un problema de falso positivo que puedes diagnosticar en treinta segundos. El diálogo es una pregunta de selección de modelo con dos respuestas documentadas.

Solo la cuarta pregunta, una persona nombrada que no consintió, no tiene ruta, y vale la pena defenderse en lugar de enrutarse alrededor. Un generador de video AI con gente real es una herramienta normal cuando la gente dijo que sí, y la razón por la que la ruta soportada se mantiene abierta es que la no soportada se mantiene cerrada.

Referencia de parámetro completo en reapi.ai/docs/seedance-2-5; tarifas actuales en la página del modelo Seedance 2.5.

References

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0
  4. r/generativeAI. Seedance keeps rejecting my AI images as "real person"; any fix? Posted 22 May 2026, retrieved August 2026 from reddit.com/r/generativeAI/comments/1tkkxjq

Further reading