Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 par seconde
Générateur vidéo IA avec vraies personnes: Ce qui marche
2026/08/09

Générateur vidéo IA avec vraies personnes: Ce qui marche

Générateur vidéo IA avec vraies personnes: références consenties prises en charge, visages synthétiques donnent faux positifs, célébrités toujours refusées.

Cherchez un générateur vidéo IA avec des vraies personnes et l'autocomplétion vous dit ce que tout le monde demande réellement: avec des personnes qui parlent, avec des personnes célèbres, personne réelle, gratuit. Ce sont quatre demandes différentes avec quatre réponses différentes, et exactement une d'elles est refusée partout, quel que soit la plateforme que vous payez.

La division utile n'est pas par outil. C'est de qui c'est le visage. Une photographie d'un sujet consentant, un personnage synthétique qui semble photoréaliste, et une célèbre personne nommée sont trois choses légalement et techniquement distinctes, et une grande partie de la frustration dans cet espace vient des plateformes qui traitent les trois comme une seule catégorie bloquée. Ceci explore ce que chacun fait réellement sur une API vidéo moderne, ce que parler demande en plus, et où la ligne ne bouge vraiment pas.

TL;DR

  • Les photos et clips de référence de personnes réelles sont pris en charge. Le paramètre de référence de Seedance 2.5 dit clairement que "les images / vidéos de référence peuvent contenir des personnes réelles."[1]
  • Le matériel de référence rejeté est remboursé entièrement. Le matériel passe une revue automatisée avant la génération, et tout ce qui est refusé échoue avec une erreur et un remboursement complet de la réserve.[2]
  • Parler est une capacité distincte. Seedance 2.5 génère "la parole synchronisée, les effets sonores et la musique de fond" avec generate_audio, activé par défaut.[1] Kling 3.0 documente explicitement la synchronisation labiale.[3]
  • Les personnalités nommées sont refusées sur chaque route. C'est la propre limite du modèle, pas une politique de plateforme, et aucun paramètre ne l'atteint.
  • Le consentement est toujours le vôtre. Une API qui accepte un téléchargement n'a pas acquis la permission en votre nom.

Quatre demandes différentes portant le même terme de recherche

Votre propre matériel, ou un sujet consentant. C'est le plus grand cas légitime: les fondateurs dans leurs propres démos de produits, les créateurs UGC, les acteurs qui ont signé une libération, un client dont vous créez la vidéo de marque. C'est pris en charge, et le reste de cet article traite principalement de cela.

Une personne synthétique qui semble photoréaliste. Votre personnage n'existe pas, mais votre générateur d'images est devenu assez bon pour que les classificateurs de visage le notent comme une photographie. C'est le cas qui génère le plus de plaintes, car le refus est un faux positif plutôt qu'une politique.

Une figure publique nommée. Refusée. Pas par reAPI comme question de politique, mais par le modèle, sur chaque hôte qui le revend. Toute plateforme affirmant le contraire se trompe ou vous vend un problème de droits de ressemblance.

Les personnes qui parlent. Une question de capacité plutôt qu'une question de permission, et elle est répondue par le modèle que vous choisissez plutôt que la plateforme.

Confondre ces derniers est pourquoi les conseils que vous trouvez en ligne sont contradictoires. Quelqu'un dont le flux de travail avec un sujet consentant fonctionne bien et quelqu'un dont le personnage synthétique continue de rebondir rapportent tous les deux précisément sur des demandes différentes.

Utiliser une personne consentante comme référence

Le chemin pris en charge est le matériel de référence, pas inviter une description. Seedance 2.5 prend jusqu'à 30 images de référence, 10 clips de référence et 10 pistes audio dans une génération.[1]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "@Image1 walks through a sunlit workshop, handheld follow",
    "resolution": "720p",
    "duration": 8,
    "image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
  }'

Les contraintes que vous devez connaître avant d'assembler un ensemble de référence:[1]

ChampLimiteFormats
image_urlsjusqu'à 30, chacun moins de 30 MBjpeg, png, webp, bmp, tiff, gif, heic, heif
video_urlsjusqu'à 10, chacun 2–30 s, moins de 200 MB, combinés 30 smp4, mov, 480p to 4K
audio_urlsjusqu'à 10, chacun 2–30 s, moins de 15 MBwav, mp3

Deux règles surprennent les gens. Chaque référence doit être une URL HTTP(S) publique; les charges base64 et data: sont refusées sur toute la plateforme, pas seulement ce modèle.[1] Et image_urls ne peuvent pas être combinés avec image_with_roles, donc les références de caractères et le chaînage premier/dernier cadre sont des modes distincts.[1]

Le matériel de référence passe une revue automatisée avant que la génération ne s'exécute. S'il est refusé, la tâche échoue avec une erreur et la réserve est remboursée entièrement,[2] ce qui signifie qu'un faux positif vous coûte une tentative plutôt que de l'argent.

Les faire parler

C'est ici que le choix du modèle importe plus que le choix de la plateforme, et les deux options documentées se comportent différemment.

Seedance 2.5 génère l'audio naturellement. generate_audio s'évalue par défaut à true et produit "la parole synchronisée, les effets sonores et la musique de fond (mono)."[1] La parole est générée avec la vidéo plutôt que doublée dessus, donc le mouvement buccal et l'audio proviennent du même passage. Vous le dirigez via l'invite.

Kling 3.0 documente la capacité de manière plus spécifique, décrivant l'audio natif synchronisé comme "dialogue, synchronisation labiale, son ambiant."[3] Si la précision de la synchronisation labiale sur le dialogue est la chose sur laquelle vous êtes jugé, c'est la réclamation explicite à tester.

Ce qu'aucun n'offre, c'est un mode de doublage où vous fournissez une piste vocale terminée et obtenez une correspondance de forme de bouche précise. Les audio_urls de Seedance 2.5 sont documentées comme des pistes audio de référence,[1] ce qui est un travail différent de la conduite de synchronisation labiale. Si votre pipeline a déjà la VO enregistrée, testez cette hypothèse sur un clip court avant de construire autour.

Une note pratique pour le travail de tête parlante: l'audio ne survit pas à la segmentation. Chaque génération synthétise sa propre piste, donc une séquence assemblée à partir de plusieurs clips vous donne plusieurs lits audio indépendants. Pour le dialogue plus long qu'une génération, enregistrez ou synthétisez la voix séparément et traitez la vidéo comme image uniquement.

La ligne qui ne bouge pas

Les personnes vivantes nommées sont refusées. Chaque honnête route l'applique, et cela reste avec le modèle plutôt qu'avec aucun paramètre de plateforme. Si un hôte prétend le contraire, la bonne réponse est la suspicion, pas une inscription.

Les personnages tiers sont aussi refusés. Le même chèque attrape les personnages reconnaissables protégeables par le droit d'auteur, ce qui est une frustration récurrente pour l'anime et le travail de fan et n'a pas de contournement digne de publication.

Le consentement n'est pas transféré par un formulaire de téléchargement. L'API acceptant votre photo de référence n'est pas la permission de la personne dedans. Les libérations, les droits de ressemblance et, dans plusieurs juridictions, les règles de données biométriques sont votre responsabilité et ne deviennent pas celles de la plateforme parce qu'une demande a renvoyé 200.

Le dernier n'est pas du charabia juridique. C'est la raison pour laquelle le chemin pris en charge existe du tout: le chèque est conçu pour arrêter le cas non consensuel, et il fonctionne mieux quand le cas légitime a quelque part pour aller.

Quand une personne qui n'existe pas est refusée

L'échec le plus courant dans cet espace est un personnage entièrement synthétique bloqué comme une personne réelle, parce que le classificateur note le photorealisme plutôt que la provenance. Il n'y a aucun moyen de savoir que votre personnage a été généré. Les utilisateurs ont signalé la même classe de refus avec des erreurs comme "Input image may contain real person" sur d'autres plateformes.[4]

La mécanique, les chaînes d'erreur exactes, et comment distinguer un détecteur de visage au niveau de la plateforme d'un chèque au niveau du modèle sont couverts dans reapi.ai/blog/seedance-face-detected-real-person-error. La version courte: le temps du refus. Un refus qui atterrit en moins d'une seconde n'a jamais atteint un GPU.

Ce que ça coûte

Le travail axé sur les références est au même prix que toute autre génération sur Seedance 2.5, avec une ride. Les images et l'audio de référence ne changent pas le taux; une vidéo de référence vous déplace vers un taux par seconde inférieur qui est facturé sur les secondes d'entrée plus sortie.[2]

Travail, 720pCoût
8 s à partir d'images de référence$2.13
30 s à partir d'images de référence$8.01
clip de référence de 10 s à sortie de 5 s$2.40

Tarifs de la bande par seconde publiée.[2] Un chèque de modération échoué est remboursé entièrement, donc les ensembles de référence exploratoires vous coûtent du temps plutôt que des crédits.

FAQ

Puis-je utiliser un générateur vidéo IA avec des vraies personnes?

Oui, avec le matériel de référence d'un sujet consentant. Le paramètre de référence de Seedance 2.5 établit que les images et vidéos de référence peuvent contenir des personnes réelles.[1]

Puis-je générer une personne célèbre?

Non. Les figures publiques nommées sont refusées au niveau du modèle sur chaque route, et aucun paramètre ne change cela.

Quel modèle gère les personnes qui parlent?

Seedance 2.5 génère la parole synchronisée aux côtés de la vidéo avec generate_audio.[1] Kling 3.0 documente le dialogue et la synchronisation labiale explicitement.[3]

Puis-je fournir mon propre enregistrement vocal et obtenir une synchronisation labiale pour cela?

Pas comme mode documenté. Les audio_urls de Seedance 2.5 sont des pistes de référence plutôt qu'un pilote de synchronisation labiale.[1] Testez-le sur un clip court avant de concevoir un pipeline autour.

Pourquoi mon personnage généré par IA a-t-il été refusé comme une personne réelle?

Parce que le chèque évalue le photorealisme, pas l'origine. Consultez l'explication de visage détecté pour comment identifier quelle couche vous a refusé.

Suis-je facturé quand une référence est refusée?

Pas sur reAPI. Une tâche qui échoue la revue rembourse la réserve entièrement.[2]

Puis-je télécharger le fichier de référence directement?

Non. Chaque référence doit être une URL HTTP(S) publique. Les charges base64 et data: sont refusées sur toute la plateforme.[1]

Combien d'images de référence peut prendre une génération?

Jusqu'à 30, plus 10 clips et 10 pistes audio.[1]

Travailler avec les visages au lieu de les contourner

Décidez laquelle des quatre demandes vous avez réellement avant de choisir un outil, car trois d'entre elles sont des décisions de produit ordinaires et une d'elles n'est disponible nulle part. Un sujet consentant et un bon ensemble de référence est un flux de travail pris en charge avec une surface de paramètre publiée et un remboursement quand la revue dit non. Un personnage synthétique photoréaliste est le même flux de travail plus un problème de faux positif que vous pouvez diagnostiquer en trente secondes. Le dialogue est une question de sélection de modèle avec deux réponses documentées.

Seule la quatrième demande, une personne nommée qui n'a pas consenti, n'a pas de route, et cela vaut la peine de le défendre plutôt que de le contourner. Un générateur vidéo IA avec des vraies personnes est un outil normal quand les personnes ont dit oui, et la raison pour laquelle le chemin pris en charge reste ouvert est que celui non pris en charge reste fermé.

Référence de paramètre complète à reapi.ai/docs/seedance-2-5; tarifs actuels sur la page du modèle Seedance 2.5.

Références

  1. reAPI. doubao-seedance-2.5-face — request body, reference limits, generate_audio and platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  3. reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0
  4. r/generativeAI. Seedance keeps rejecting my AI images as "real person"; any fix? Posted 22 May 2026, retrieved August 2026 from reddit.com/r/generativeAI/comments/1tkkxjq

Lectures supplémentaires