
Generador de vídeo IA con personas reales: qué funciona
Generador de vídeo IA con personas reales: referencias permitidas, diálogo nativo, límites documentados, sistema de moderación y costes reales.
¿Se puede usar un generador de vídeo IA con personas reales? Sí, cuando el sujeto ha consentido y la ruta elegida documenta referencias a personas reales. Las preguntas prácticas son si la entrada se acepta, si el modelo genera discurso, cómo funciona la revisión y cuánto cuesta el trabajo.
La división útil no es por herramienta. Es por quién aparece. Una fotografía de un sujeto que consintió, un personaje sintético y una celebridad nominada son entradas legalmente y técnicamente distintas. Esta guía explica la ruta documentada para cada caso, qué requiere audio y qué comprobar cuando una referencia es rechazada.
TL;DR
- Las fotos y clips de referencia con personas reales son compatibles. El parámetro de referencia de Seedance 2.5 deja claro que "las imágenes/vídeos de referencia pueden contener personas reales".[1]
- El material rechazado de referencia se reembolsa completamente. El material pasa la revisión automatizada antes de la generación, y cualquier rechazo falla con un error y un reembolso completo de la reserva.[2]
- Hablar es una capacidad independiente. Seedance 2.5 genera "discurso sincronizado, efectos de sonido y música de fondo" con
generate_audio, activado por defecto.[1] Kling 3.0 documenta la sincronización de labios explícitamente.[3] - Las celebridades nominadas son rechazadas en todas las rutas. Esa es la propia línea del modelo, no una configuración de política de plataforma, y ningún parámetro la alcanza.
- El consentimiento sigue siendo tuyo. Una API que acepta una carga no ha adquirido permiso en tu nombre.
Cuatro preguntas distintas bajo un mismo término de búsqueda
Tu propio material, o un sujeto que consintió. Este es el caso legítimo más grande: fundadores en sus propias demostraciones de producto, creadores UGC, actores que firmaron una liberación, un cliente cuyo vídeo de marca estás haciendo. Es compatible, y el resto de este artículo trata principalmente sobre ello.
Una persona sintética cuya referencia es rechazada. El error solo no prueba cómo un sistema de revisión clasificó la imagen o qué comprobación interna hizo que se rechazara. Comprueba los requisitos de entrada documentados y el resultado de la revisión antes de decidir qué lo causó.
Una figura pública nominada. Rechazada. No por reAPI como cuestión de política, sino por el modelo, en todos los anfitriones que lo revenden. Cualquier plataforma que afirme lo contrario está equivocada o te está vendiendo un problema de derechos de similitud.
Personas hablando. Una pregunta de capacidad más que de permiso, y se responde con qué modelo eliges en lugar de con qué plataforma eliges.
Mantén estos casos separados cuando resuelvas problemas. Una referencia de persona real compatible, una referencia sintética rechazada y una solicitud de una persona nominada no tienen el mismo paso siguiente.
Usar una persona consentida como referencia
La ruta compatible es material de referencia, no la descripción de un aviso. Seedance 2.5 toma hasta 30 imágenes de referencia, 10 clips de referencia y 10 pistas de audio en una generación.[1]
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer rk_live_your_key" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "@Image1 walks through a sunlit workshop, handheld follow",
"resolution": "720p",
"duration": 8,
"image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
}'Las restricciones que vale la pena conocer antes de montar un conjunto de referencias:[1]
| Campo | Límite | Formatos |
|---|---|---|
image_urls | hasta 30, cada una menos de 30 MB | jpeg, png, webp, bmp, tiff, gif, heic, heif |
video_urls | hasta 10, cada una 2–30 s, menos de 200 MB, combinadas 30 s | mp4, mov, 480p a 4K |
audio_urls | hasta 10, cada una 2–30 s, menos de 15 MB | wav, mp3 |
Dos reglas sorprenden a la gente. Cada referencia debe ser una URL HTTP(S) pública; los payloads base64 y data: son rechazados en toda la plataforma, no solo en este modelo.[1] Y image_urls no se puede combinar con image_with_roles, por lo que las referencias de personaje y la cadena del primer/último fotograma son modos separados.[1]
El material de referencia pasa por la revisión automatizada antes de ejecutar la generación. Si es rechazado, la tarea falla con un error y la reserva se reembolsa completamente,[2] por lo que un intento rechazado cuesta tiempo en lugar de la cantidad reservada.
Hacerlos hablar
Aquí es donde la elección del modelo importa más que la elección de la plataforma, y las dos opciones documentadas se comportan de manera diferente.
Seedance 2.5 genera audio de forma nativa. generate_audio por defecto es true y produce "discurso sincronizado, efectos de sonido y música de fondo (mono)".[1] El discurso se genera con el vídeo en lugar de doblarse en él, por lo que el movimiento de la boca y el audio provienen de la misma pasada. Lo diriges a través del aviso.
Kling 3.0 documenta la capacidad más específicamente, describiendo audio nativo sincronizado como "diálogo, sincronización de labios, sonido ambiental".[3] Si la precisión de la sincronización de labios en el diálogo es lo que se está juzgando, eso es lo que hay que probar explícitamente.
Lo que ninguno ofrece es un modo de doblaje donde proporcionas una pista de voz terminada y obtienes una coincidencia precisa de la forma de la boca. Los audio_urls de Seedance 2.5 están documentados como pistas de audio de referencia,[1] lo que es un trabajo diferente de la conducción de sincronización de labios. Si tu pipeline ya tiene VO grabado, prueba esa suposición en un clip corto antes de construir alrededor de ella.
Una nota práctica para el trabajo de cabeza hablante: el audio no sobrevive a la segmentación. Cada generación sintetiza su propio track, por lo que una secuencia montada desde varios clips te da varias camas de audio independientes. Para diálogos más largos que una generación, graba o sintetiza la voz por separado y trata el vídeo como solo imagen.
La línea que no se mueve
Las personas vivas nominadas son rechazadas. Todas las rutas honestas lo hacen cumplir, y reside con el modelo en lugar de con cualquier configuración de plataforma. Si un anfitrión afirma lo contrario, la respuesta correcta es sospecha, no un registro.
Los personajes de terceros también son rechazados. El mismo control captura personajes con derechos de autor reconocibles, lo que es una frustración recurrente para anime y trabajo de aficionados y no tiene solución que valga la pena publicar.
El consentimiento no se transfiere por un formulario de carga. La API que acepta tu foto de referencia no es permiso de la persona en ella. Liberaciones, derechos de similitud y, en varias jurisdicciones, reglas de datos biométricos son tu responsabilidad y no se convierten en la de la plataforma porque una solicitud devolvió 200.
Esa última no es jerga legal. Es la razón por la que existe la ruta compatible: el control está diseñado para detener el caso no consensuado, y funciona mejor cuando el caso legítimo tiene un lugar a dónde ir.
Cuando una referencia sintética es rechazada
Un mensaje de rechazo no establece si la referencia fue rechazada debido a su contenido, su formato u otra regla de revisión. No deduzcas el mecanismo interno solo de la redacción. Primero confirma que la URL, tipo de archivo, tamaño, duración y combinación de campos coincidan con la referencia de parámetro publicada.[1]
Si la entrada es válida pero la revisión automatizada aún la rechaza, trata ese resultado como un resultado de moderación en lugar de prueba sobre el origen de la imagen. Intenta otra referencia compatible o un modelo cuya política de entrada documentada se ajuste al trabajo. La guía de solución de problemas de detección de cara separa la validación de entrada de la revisión sin adivinar qué sistema interno produjo el mensaje.
Cuánto cuesta
El trabajo impulsado por referencias se valora igual que cualquier otra generación en Seedance 2.5, con un giro. Las imágenes de referencia y el audio no cambian la tarifa; un vídeo de referencia te mueve a una tarifa por segundo más baja. reAPI luego factura max(salida + ceil(duración total del vídeo fuente), ceil(5 / 3 × salida)) segundos.[2]
| Trabajo, 720p | Costo |
|---|---|
| 8 s desde imágenes de referencia | $2.135 |
| 30 s desde imágenes de referencia | $8.005 |
| Clip de referencia de 10 s a salida de 5 s | $2.402 |
Tarifas de la banda por segundo publicada.[2] Un control de moderación fallido se reembolsa completamente, por lo que los conjuntos de referencias exploratorios cuestan tiempo en lugar de créditos.
FAQ
¿Puedo usar un generador de vídeo IA con personas reales?
Sí, con material de referencia de un sujeto que consintió. El parámetro de referencia de Seedance 2.5 establece que las imágenes y vídeos de referencia pueden contener personas reales.[1]
¿Puedo generar una persona famosa?
No. Las figuras públicas nominadas son rechazadas a nivel de modelo en todas las rutas, y ningún parámetro cambia eso.
¿Qué modelo maneja a personas hablando?
Seedance 2.5 genera discurso sincronizado junto con el vídeo con generate_audio.[1] Kling 3.0 documenta diálogo y sincronización de labios explícitamente.[3]
¿Puedo proporcionar mi propia grabación de voz y obtener sincronización de labios para ella?
No como un modo documentado. Los audio_urls de Seedance 2.5 son pistas de referencia en lugar de un controlador de sincronización de labios.[1] Pruébalo en un clip corto antes de diseñar un pipeline alrededor de él.
¿Por qué mi personaje generado por IA fue rechazado como una persona real?
El mensaje no revela la razón interna. Verifica primero la URL de referencia, el formato, el tamaño y la combinación de campos; si esos son válidos, maneja el resultado como un rechazo de revisión. El explicador de detección de cara proporciona una lista de control documentada.
¿Soy cobrado cuando una referencia es rechazada?
No en reAPI. Una tarea que falla la revisión reembolsa la reserva completamente.[2]
¿Puedo cargar el archivo de referencia directamente?
No. Cada referencia debe ser una URL HTTP(S) pública. Los payloads base64 y data: son rechazados en toda la plataforma.[1]
¿Cuántas imágenes de referencia puede tomar una generación?
Hasta 30, más 10 clips y 10 pistas de audio.[1]
Trabajar con caras en lugar de alrededor de ellas
Decide cuál de los cuatro preguntas realmente tienes antes de elegir una herramienta. Un sujeto consentido y un conjunto de referencias válidas forman un flujo de trabajo compatible con parámetros publicados y un reembolso cuando la revisión dice que no. Una referencia sintética rechazada necesita una comprobación de entrada y revisión, no una adivinanza sobre el clasificador oculto. El diálogo sigue siendo una pregunta de selección de modelo con dos respuestas documentadas.
Solo la cuarta pregunta, una persona nominada que no estuvo de acuerdo, no tiene ruta, y eso vale la pena defender en lugar de rodear. Un generador de vídeo IA con personas reales es una herramienta normal cuando las personas dijeron sí, y la razón por la que la ruta compatible se mantiene abierta es que la ruta no compatible se mantiene cerrada.
Referencia de parámetros completos en reapi.ai/docs/seedance-2-5; tasas actuales en la página de modelo Seedance 2.5.
References
- reAPI. doubao-seedance-2.5-face — request body, reference limits,
generate_audioand platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5 - reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
- reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0
Further reading
- reAPI. Seedance Face Detected: Real Person Errors, Explained. reapi.ai/blog/seedance-face-detected-real-person-error
- reAPI. AI Video Generator Long Videos: Chaining Past the Cap. reapi.ai/blog/ai-video-generator-long-videos
Autor

Categorías
Más publicaciones

Precios de Seedance 2.5 en agosto 2026: fal vs kie vs reAPI
Precios de Seedance 2.5 en cuatro plataformas, agosto 2026: diferenciales 1.8x, facturación diferente para referencias, tres ejemplos prácticos.


¿Qué puede hacer reAPI? Casos de uso de imagen, vídeo y LLM
Descubre qué puede hacer reAPI hoy: API separadas para chat y medios cubren imagen, vídeo, audio y lenguaje, con casos reales y guía de inicio.


Suno V6 API: versiones y migración de su integración
Actualice su integración Suno V6 API: elija V6, Mini o Wild, cambie campos a snake_case, consulte tareas asíncronas y calcule las tarifas de cada solicitud.
