
KI-Videogenerator mit echten Personen: Was wirklich klappt
KI-Videogenerator mit echten Personen: Einverständnis-Referenzen funktionieren, synthetische Gesichter geben Fehlalarme, Prominente überall abgelehnt.
Suchen Sie nach einem KI-Videogenerator mit echten Personen, und die Autovervollständigung zeigt Ihnen, was alle wirklich fragen: mit sprechenden Personen, mit berühmten Personen, echte Person, kostenlos. Das sind vier verschiedene Anfragen mit vier verschiedenen Antworten, und genau eine davon wird überall abgelehnt, egal welche Plattform Sie bezahlen.
Die nützliche Aufteilung ist nicht nach Tool. Sie ist danach, wessen Gesicht es ist. Ein Foto eines zustimmenden Motivs, ein synthetischer Charakter, der zufällig fotorealistisch aussieht, und eine benannte Berühmtheit sind drei rechtlich und technisch unterschiedliche Dinge, und ein großer Teil der Frustration in diesem Bereich kommt daher, dass Plattformen alle drei als eine blockierte Kategorie behandeln. Dies erläutert, was jede davon tatsächlich auf einer modernen Video-API tut, was Sprechen darüber hinaus erfordert, und wo die Linie wirklich nicht bewegt wird.
TL;DR
- Referenzfotos und Clips von echten Personen werden unterstützt. Die Parameterreferenz von Seedance 2.5 besagt deutlich, dass „Referenzbilder / Videos echte Personen enthalten können."[1]
- Abgelehnte Referenzmaterialien erstatten vollständig Kosten. Material wird vor der Generierung automatisch überprüft, und alles, was abgelehnt wird, schlägt fehl mit einem Fehler und einer vollständigen Rückerstattung der Reserve.[2]
- Sprechen ist eine separate Fähigkeit. Seedance 2.5 generiert „synchronisierte Sprache, Soundeffekte und Hintergrundmusik" mit
generate_audio, standardmäßig aktiviert.[1] Kling 3.0 dokumentiert Lippensynchronisation explizit.[3] - Benannte Prominente werden auf jeder Route abgelehnt. Das ist die eigene Linie des Modells, nicht eine Plattformrichtlinie, und kein Parameter erreicht sie.
- Zustimmung liegt immer noch bei Ihnen. Eine API, die einen Upload akzeptiert, hat auf Ihrem Namen keine Erlaubnis erworben.
Vier verschiedene Anfragen mit einem Suchbegriff
Ihr eigenes Material oder ein zustimmendes Motiv. Dies ist der größte legitime Fall: Gründer in ihren eigenen Produktdemos, UGC-Ersteller, Schauspieler, die eine Freigabe unterzeichnet haben, ein Kunde, dessen Markenvideo Sie erstellen. Es wird unterstützt, und der Rest dieses Artikels handelt größtenteils davon.
Eine synthetische Person, die fotorealistisch aussieht. Ihr Charakter existiert nicht, aber Ihr Bildgenerator wurde so gut, dass Gesichtsklassifizierer ihn als Fotografie bewerten. Dies ist der Fall, der die meisten Beschwerden verursacht, da die Ablehnung ein Fehlalarm ist und nicht nur eine Richtlinie.
Eine benannte öffentliche Person. Abgelehnt. Nicht von reAPI als Richtlinie, sondern vom Modell auf jedem Host, der es weiterverkauft. Jede Plattform, die sonst wirbt, irrt sich entweder oder verkauft Ihnen ein Ähnlichkeitsrechte-Problem.
Personen sprechen. Eine Fähigkeitsfrage eher als eine Berechtigungsfrage, und sie wird durch die Wahl des Modells beantwortet, nicht durch die Wahl der Plattform.
Das Vermischen dieser ist der Grund, warum der Rat, den Sie online finden, widersprüchlich ist. Jemand, dessen Workflow mit zustimmendem Motiv einwandfrei funktioniert, und jemand, dessen synthetischer Charakter immer abprallt, berichten beide korrekt über verschiedene Anfragen.
Ein zustimmendes Motiv als Referenz verwenden
Der unterstützte Weg ist Referenzmaterial, nicht die Beschreibung eines Bildes. Seedance 2.5 nimmt bis zu 30 Referenzbilder, 10 Referenzclips und 10 Audiotracks in einer Generierung.[1]
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer rk_live_your_key" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "@Image1 walks through a sunlit workshop, handheld follow",
"resolution": "720p",
"duration": 8,
"image_urls": ["https://your-cdn.example.com/subject-01.jpg"]
}'Die Einschränkungen, die Sie vor der Zusammenstellung eines Referenzsatzes kennen sollten:[1]
| Feld | Limit | Formate |
|---|---|---|
image_urls | bis zu 30, jeweils unter 30 MB | jpeg, png, webp, bmp, tiff, gif, heic, heif |
video_urls | bis zu 10, jeweils 2–30 s, unter 200 MB, kombiniert 30 s | mp4, mov, 480p to 4K |
audio_urls | bis zu 10, jeweils 2–30 s, unter 15 MB | wav, mp3 |
Zwei Regeln überraschen Leute. Jede Referenz muss eine öffentliche HTTP(S)-URL sein; Base64 und data:-Payloads werden auf der ganzen Plattform abgelehnt, nicht nur bei diesem Modell.[1] Und image_urls können nicht mit image_with_roles kombiniert werden, daher sind Charakterreferenzen und Verkettung von Erst-/Letztbild separate Modi.[1]
Referenzmaterial durchläuft automatische Überprüfung, bevor die Generierung läuft. Wenn es abgelehnt wird, schlägt die Aufgabe mit einem Fehler fehl und die Reserve wird vollständig rückerstattet,[2] was bedeutet, dass ein Fehlalarm Sie einen Wiederversuch statt Geld kostet.
Sie zum Sprechen bringen
Dies ist, wo die Modellwahl mehr zählt als die Plattformwahl, und die beiden dokumentierten Optionen verhalten sich unterschiedlich.
Seedance 2.5 generiert Audio nativ. generate_audio standardisiert auf true und produziert „synchronisierte Sprache, Soundeffekte und Hintergrundmusik (Mono)."[1] Die Sprache wird mit dem Video generiert, nicht dubben, sodass Mundbewegung und Audio aus dem gleichen Durchgang stammen. Sie lenken das durch den Prompt.
Kling 3.0 dokumentiert die Fähigkeit genauer und beschreibt synchronisiertes natives Audio als „Dialog, Lippensynchronisation, Umgebungston."[3] Wenn die Genauigkeit der Lippensynchronisation im Dialog das ist, worüber Sie beurteilt werden, ist das die explizite Behauptung zum Testen.
Was keiner bietet, ist ein Dubbing-Modus, in dem Sie eine fertige Voice-Spur liefern und genaue Mundformabstimmung dazu erhalten. Seedance 2.5s audio_urls werden als Referenz-Audiotracks dokumentiert,[1] was ein anderer Job als Lippensynchronisations-Fahren ist. Wenn Ihre Pipeline bereits aufgezeichnetes VO hat, testen Sie diese Annahme auf einem kurzen Clip, bevor Sie danach bauen.
Ein praktischer Hinweis für Sprechkopf-Arbeit: Audio überlebt Segmentierung nicht. Jede Generierung synthetisiert ihre eigene Spur, daher gibt eine aus mehreren Clips zusammengesetzte Sequenz Ihnen mehrere unabhängige Audiobetten. Für Dialog länger als eine Generierung, nehmen Sie die Stimme separat auf oder synthetisieren Sie und behandeln Sie das Video als nur Bild.
Die Linie, die sich nicht bewegt
Benannte lebende Personen werden abgelehnt. Jede ehrliche Route setzt das durch, und es sitzt mit dem Modell, nicht mit irgendeinen Plattformeinstellungen. Wenn ein Host sonst behauptet, ist die richtige Antwort Verdacht, nicht eine Anmeldung.
Dritte Charaktere werden auch abgelehnt. Der gleiche Check erfasst erkennbare urheberrechtlich geschützte Charaktere, was eine wiederkehrende Frustration für Anime und Fan-Arbeit ist und keine verlegerische Lösung hat.
Zustimmung wird nicht durch ein Upload-Formular übertragen. Die API, die Ihr Referenzfoto akzeptiert, ist keine Erlaubnis von der Person darin. Freigaben, Ähnlichkeitsrechte und, in mehreren Rechtsordnungen, biometrische Datenregeln sind Ihre Verantwortung und werden nicht der Plattform, weil eine Anfrage 200 zurückgab.
Das letzte ist keine Rechtsboilerplate. Es ist der Grund, warum der unterstützte Weg überhaupt existiert: Der Check soll den nicht-konsensualen Fall verhindern, und er funktioniert besser, wenn der legitime Fall einen Platz zum Gehen hat.
Wenn eine Person, die nicht existiert, abgelehnt wird
Der häufigste Fehler in diesem Bereich ist ein vollständig synthetischer Charakter, der als reale Person blockiert wird, weil der Klassifizierer Fotorealismus statt Herkunft bewertet. Es gibt keine Möglichkeit zu wissen, dass Ihr Charakter generiert wurde. Benutzer haben die gleiche Ablehnung mit Fehlern wie „Input image may contain real person" auf anderen Plattformen gemeldet.[4]
Die Mechanik, die genauen Fehlerzeichenfolgen und wie man einen Plattform-Level-Gesichtsdetektor von einer Modell-Level-Prüfung unterscheidet, werden in reapi.ai/blog/seedance-face-detected-real-person-error behandelt. Die Kurzversion: Zeit der Ablehnung. Eine Weigerung, die in unter einer Sekunde ankommt, hat nie eine GPU erreicht.
Was kostet es
Referenzgetriebene Arbeit wird gleich wie jede andere Generierung auf Seedance 2.5 bepreist, mit einer Falte. Referenzbilder und Audio ändern nicht die Rate; ein Referenz-Video bewegt Sie zu einer niedrigeren Pro-Sekunden-Rate, die über Eingabe- und Ausgabesekunden abgerechnet wird.[2]
| Job, 720p | Kosten |
|---|---|
| 8 s aus Referenzbildern | $2.13 |
| 30 s aus Referenzbildern | $8.01 |
| 10 s Referenzclip zu 5 s Ausgabe | $2.40 |
Raten aus der veröffentlichten Pro-Sekunden-Bande.[2] Ein fehlgeschlagener Moderationsprüfung erstattet vollständig, sodass explorative Referenzsätze Zeit statt Credits kosten.
FAQ
Kann ich einen KI-Videogenerator mit echten Personen verwenden?
Ja, mit Referenzmaterial eines zustimmenden Motivs. Die Parameterreferenz von Seedance 2.5 gibt an, dass Referenzbilder und Videos echte Personen enthalten können.[1]
Kann ich eine berühmte Person generieren?
Nein. Benannte öffentliche Personen werden auf Modell-Ebene auf jeder Route abgelehnt, und kein Parameter ändert das.
Welches Modell handhaby Menschen sprechen?
Seedance 2.5 generiert synchronisierte Sprache neben dem Video mit generate_audio.[1] Kling 3.0 dokumentiert Dialog und Lippensynchronisation explizit.[3]
Kann ich meine eigene Sprachaufzeichnung liefern und Lippensynchronisation dafür erhalten?
Nicht als dokumentierter Modus. Seedance 2.5s audio_urls sind Referenztracks statt eines Lippensynchronisations-Fahrers.[1] Testen Sie es auf einem kurzen Clip, bevor Sie eine Pipeline danach auslegen.
Warum wurde mein KI-generierter Charakter als echte Person abgelehnt?
Weil die Prüfung Fotorealismus bewertet, nicht Herkunft. Siehe die Gesichtserkannte Erklärung für wie man identifiziert, welche Ebene Sie abgelehnt hat.
Werden mir Gebühren berechnet, wenn eine Referenz abgelehnt wird?
Nicht auf reAPI. Eine Aufgabe, die Überprüfung schlägt, erstattet die Reserve vollständig.[2]
Kann ich die Referenzdatei direkt hochladen?
Nein. Jede Referenz muss eine öffentliche HTTP(S)-URL sein. Base64 und data:-Payloads werden plattformweit abgelehnt.[1]
Wie viele Referenzbilder kann eine Generierung aufnehmen?
Bis zu 30, plus 10 Clips und 10 Audiotracks.[1]
Mit Gesichtern arbeiten statt um sie herum
Entscheiden Sie, welche der vier Anfragen Sie tatsächlich haben, bevor Sie ein Tool auswählen, denn drei davon sind gewöhnliche Produktentscheidungen und eine davon ist nirgends verfügbar. Ein zustimmendes Motiv und ein guter Referenzsatz ist ein unterstützter Workflow mit einer veröffentlichten Parameteroberfläche und eine Rückerstattung, wenn Überprüfung sagt nein. Ein fotorealistischer synthetischer Charakter ist der gleiche Workflow plus ein Fehlalarm-Problem, das Sie in dreißig Sekunden diagnostizieren können. Dialog ist eine Modellauswahl-Frage mit zwei dokumentierten Antworten.
Nur die vierte Anfrage, eine benannte Person, die nicht zugestimmt hat, hat keine Route, und das ist wert, zu verteidigen, nicht zu umgehen. Ein KI-Videogenerator mit echten Personen ist ein normales Tool, wenn die Personen ja sagten, und der Grund der unterstützte Weg offen bleibt, ist, dass der nicht unterstützte bleibt geschlossen.
Vollständige Parameterreferenz unter reapi.ai/docs/seedance-2-5; aktuelle Raten auf der Seedance 2.5 Modellseite.
Referenzen
- reAPI. doubao-seedance-2.5-face — request body, reference limits,
generate_audioand platform media rules. Retrieved August 2026 from reapi.ai/docs/seedance-2-5 - reAPI. Seedance 2.5 — model page, real-person reference support, published rates and refund behaviour. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
- reAPI. Kling 3.0 — native audio with dialogue and lip sync. Retrieved August 2026 from reapi.ai/docs/kling-3-0
- r/generativeAI. Seedance keeps rejecting my AI images as "real person"; any fix? Posted 22 May 2026, retrieved August 2026 from reddit.com/r/generativeAI/comments/1tkkxjq
Weitere Ressourcen
- reAPI. Seedance Face Detected: Real Person Errors, Explained. reapi.ai/blog/seedance-face-detected-real-person-error
- reAPI. AI Video Generator Long Videos: Chaining Past the Cap. reapi.ai/blog/ai-video-generator-long-videos
Autor

Kategorien
Weitere Beiträge

Unbegrenzte KI-Videogenerator-Tarife: So rechnet man richtig
Vierstufiger Test für unbegrenzte KI-Videogenerator-Tarife: Nur Zahlen vom Anbieter verwenden, plus die acht Stellen, wo die echte Grenze versteckt ist.


AtlasCloud-Alternativen 2026: 5 Tools im Vergleich
Vergleichen Sie AtlasCloud-Alternativen 2026? So schneiden fal.ai, Replicate, Together AI, RunPod und reAPI bei Preis, Modellen und OpenAI-kompatiblen APIs ab.


KI lange Videos: Verkettung über die Grenze
AI-Videos maximal 30 Sekunden pro Erzeugung. Segmente verketten ohne Naht, Parameter-Regeln, sichtbare Bruchstellen, und Kosten für drei Minuten Video.
