Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Générateur vidéo IA avec vraies personnes: Ce qui marche
2026/08/09

Générateur vidéo IA avec vraies personnes: Ce qui marche

Utiliser de vraies personnes en vidéo IA : références consenties, dialogue natif, limites d'entrée, contrôle du contenu et coût de génération.

Peut-on utiliser de vraies personnes avec un générateur vidéo IA ? Oui, si le sujet a donné son accord et si la voie choisie documente la prise en charge des références humaines. Il faut ensuite vérifier l'entrée, la génération de parole, le contrôle du contenu et le coût de la tâche.

La distinction utile ne se fait pas d'abord par outil, mais par identité. La photo d'un sujet consentant, un personnage synthétique et une personnalité nommée sont des entrées juridiquement et techniquement différentes. Ce guide présente les voies documentées, les exigences liées au dialogue et les vérifications à effectuer lorsqu'une référence est refusée.

TL;DR

  • Les photos et clips de référence de personnes réelles sont pris en charge. Le paramètre de référence de Seedance 2.5 dit clairement que "les images / vidéos de référence peuvent contenir des personnes réelles."[1]
  • Le matériel de référence rejeté est remboursé entièrement. Le matériel passe une revue automatisée avant la génération, et tout ce qui est refusé échoue avec une erreur et un remboursement complet de la réserve.[2]
  • Parler est une capacité distincte. Seedance 2.5 génère "la parole synchronisée, les effets sonores et la musique de fond" avec generate_audio, activé par défaut.[1] Kling 3.0 documente explicitement la synchronisation labiale.[3]
  • Les personnalités nommées sont refusées sur chaque route. C'est la propre limite du modèle, pas une politique de plateforme, et aucun paramètre ne l'atteint.
  • Le consentement est toujours le vôtre. Une API qui accepte un téléchargement n'a pas acquis la permission en votre nom.

Quatre demandes différentes portant le même terme de recherche

Votre propre matériel, ou un sujet consentant. C'est le plus grand cas légitime: les fondateurs dans leurs propres démos de produits, les créateurs UGC, les acteurs qui ont signé une libération, un client dont vous créez la vidéo de marque. C'est pris en charge, et le reste de cet article traite principalement de cela.

Une personne synthétique dont la référence est refusée. Le message d'erreur ne révèle ni la manière dont l'image a été examinée, ni le contrôle interne qui a pris la décision. Vérifiez les exigences d'entrée et le résultat du contrôle avant d'en déduire la cause.

Une figure publique nommée. Refusée. Pas par reAPI comme question de politique, mais par le modèle, sur chaque hôte qui le revend. Toute plateforme affirmant le contraire se trompe ou vous vend un problème de droits de ressemblance.

Les personnes qui parlent. Une question de capacité plutôt qu'une question de permission, et elle est répondue par le modèle que vous choisissez plutôt que la plateforme.

Séparez ces cas pendant le diagnostic. Une référence humaine prise en charge, une référence synthétique refusée et une demande visant une personne nommée n'appellent pas la même réponse.

Utiliser une personne consentante comme référence

Le chemin pris en charge est le matériel de référence, pas inviter une description. Seedance 2.5 prend jusqu'à 30 images de référence, 10 clips de référence et 10 pistes audio dans une génération.[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

Les contraintes que vous devez connaître avant d'assembler un ensemble de référence:[1]

ChampLimiteFormats
image_urlsjusqu'à 30, chacun moins de 30 MBjpeg, png, webp, bmp, tiff, gif, heic, heif
video_urlsjusqu'à 10, chacun 2–30 s, moins de 200 MB, combinés 30 smp4, mov, 480p to 4K
audio_urlsjusqu'à 10, chacun 2–30 s, moins de 15 MBwav, mp3

Deux règles surprennent les gens. Chaque référence doit être une URL HTTP(S) publique; les charges base64 et data: sont refusées sur toute la plateforme, pas seulement ce modèle.[1] Et image_urls ne peuvent pas être combinés avec image_with_roles, donc les références de caractères et le chaînage premier/dernier cadre sont des modes distincts.[1]

Le matériel de référence passe un contrôle automatisé avant la génération. S'il est refusé, la tâche échoue avec une erreur et la somme réservée est intégralement remboursée,[2] si bien qu'un essai refusé coûte du temps, pas cette somme.

Les faire parler

C'est ici que le choix du modèle importe plus que le choix de la plateforme, et les deux options documentées se comportent différemment.

Seedance 2.5 génère l'audio naturellement. generate_audio s'évalue par défaut à true et produit "la parole synchronisée, les effets sonores et la musique de fond (mono)."[1] La parole est générée avec la vidéo plutôt que doublée dessus, donc le mouvement buccal et l'audio proviennent du même passage. Vous le dirigez via l'invite.

Kling 3.0 documente la capacité de manière plus spécifique, décrivant l'audio natif synchronisé comme "dialogue, synchronisation labiale, son ambiant."[3] Si la précision de la synchronisation labiale sur le dialogue est la chose sur laquelle vous êtes jugé, c'est la réclamation explicite à tester.

Ce qu'aucun n'offre, c'est un mode de doublage où vous fournissez une piste vocale terminée et obtenez une correspondance de forme de bouche précise. Les audio_urls de Seedance 2.5 sont documentées comme des pistes audio de référence,[1] ce qui est un travail différent de la conduite de synchronisation labiale. Si votre pipeline a déjà la VO enregistrée, testez cette hypothèse sur un clip court avant de construire autour.

Une note pratique pour le travail de tête parlante: l'audio ne survit pas à la segmentation. Chaque génération synthétise sa propre piste, donc une séquence assemblée à partir de plusieurs clips vous donne plusieurs lits audio indépendants. Pour le dialogue plus long qu'une génération, enregistrez ou synthétisez la voix séparément et traitez la vidéo comme image uniquement.

La ligne qui ne bouge pas

Les personnes vivantes nommées sont refusées. Chaque honnête route l'applique, et cela reste avec le modèle plutôt qu'avec aucun paramètre de plateforme. Si un hôte prétend le contraire, la bonne réponse est la suspicion, pas une inscription.

Les personnages tiers sont aussi refusés. Le même chèque attrape les personnages reconnaissables protégeables par le droit d'auteur, ce qui est une frustration récurrente pour l'anime et le travail de fan et n'a pas de contournement digne de publication.

Le consentement n'est pas transféré par un formulaire de téléchargement. L'API acceptant votre photo de référence n'est pas la permission de la personne dedans. Les libérations, les droits de ressemblance et, dans plusieurs juridictions, les règles de données biométriques sont votre responsabilité et ne deviennent pas celles de la plateforme parce qu'une demande a renvoyé 200.

Le dernier n'est pas du charabia juridique. C'est la raison pour laquelle le chemin pris en charge existe du tout: le chèque est conçu pour arrêter le cas non consensuel, et il fonctionne mieux quand le cas légitime a quelque part pour aller.

Quand une référence synthétique est refusée

Un message de refus ne permet pas de savoir si le problème vient du contenu, du format ou d'une autre règle de contrôle. N'en déduisez pas le mécanisme interne. Vérifiez d'abord l'URL, le type de fichier, la taille, la durée et la combinaison de champs dans la documentation des paramètres.[1]

Si l'entrée est valide mais que le contrôle automatisé la refuse encore, traitez ce résultat comme une décision de modération, et non comme une preuve sur l'origine de l'image. Essayez une autre référence conforme ou un modèle dont la politique d'entrée documentée convient mieux. Le guide de diagnostic Face Detected sépare la validation de l'entrée du contrôle sans spéculer sur le système interne.

Ce que ça coûte

Le travail fondé sur des références est tarifé comme toute autre génération Seedance 2.5, avec une particularité. Les images et l'audio de référence ne changent pas le tarif ; une vidéo de référence active le tarif inférieur par seconde. reAPI facture alors max(sortie + ceil(durée totale des vidéos sources), ceil(5 / 3 × sortie)) secondes.[2]

Travail, 720pCoût
8 s à partir d'images de référence$2.135
30 s à partir d'images de référence$8.005
clip de référence de 10 s vers une sortie de 5 s$2.402

Les valeurs utilisent les tarifs à la seconde publiés et l'arrondi unique de toute la requête au crédit entier.[2] Un contrôle de modération refusé est entièrement remboursé ; les jeux de références exploratoires coûtent donc du temps plutôt que des crédits.

FAQ

Puis-je utiliser un générateur vidéo IA avec des vraies personnes?

Oui, avec le matériel de référence d'un sujet consentant. Le paramètre de référence de Seedance 2.5 établit que les images et vidéos de référence peuvent contenir des personnes réelles.[1]

Puis-je générer une personne célèbre?

Non. Les figures publiques nommées sont refusées au niveau du modèle sur chaque route, et aucun paramètre ne change cela.

Quel modèle gère les personnes qui parlent?

Seedance 2.5 génère la parole synchronisée aux côtés de la vidéo avec generate_audio.[1] Kling 3.0 documente le dialogue et la synchronisation labiale explicitement.[3]

Puis-je fournir mon propre enregistrement vocal et obtenir une synchronisation labiale pour cela?

Pas comme mode documenté. Les audio_urls de Seedance 2.5 sont des pistes de référence plutôt qu'un pilote de synchronisation labiale.[1] Testez-le sur un clip court avant de concevoir un pipeline autour.

Pourquoi mon personnage généré par IA a-t-il été refusé comme une personne réelle?

Le message ne donne pas la raison interne. Vérifiez d'abord l'URL, le format, la taille et la combinaison de champs ; si tout est valide, traitez le résultat comme un refus de contrôle. L'explication Face Detected fournit une liste de vérification fondée sur la documentation.

Suis-je facturé quand une référence est refusée?

Pas sur reAPI. Une tâche qui échoue la revue rembourse la réserve entièrement.[2]

Puis-je télécharger le fichier de référence directement?

Non. Chaque référence doit être une URL HTTP(S) publique. Les charges base64 et data: sont refusées sur toute la plateforme.[1]

Combien d'images de référence peut prendre une génération?

Jusqu'à 30, plus 10 clips et 10 pistes audio.[1]

Travailler avec les visages au lieu de les contourner

Déterminez d'abord laquelle des quatre demandes correspond à votre projet. Un sujet consentant et un jeu de références valide relèvent d'un flux pris en charge, avec des paramètres publiés et un remboursement en cas de rejet. Une référence synthétique refusée exige de vérifier l'entrée et le contrôle, sans deviner le classificateur caché. Le dialogue reste une question de choix de modèle avec deux réponses documentées.

Seule la quatrième demande, une personne nommée qui n'a pas consenti, n'a pas de route, et cela vaut la peine de le défendre plutôt que de le contourner. Un générateur vidéo IA avec des vraies personnes est un outil normal quand les personnes ont dit oui, et la raison pour laquelle le chemin pris en charge reste ouvert est que celui non pris en charge reste fermé.

Référence de paramètre complète à reapi.ai/docs/seedance-2-5; tarifs actuels sur la page du modèle Seedance 2.5.

Références

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0

Lectures supplémentaires