Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
GPT Image 2 + Seedance 2.0 : flux de cohérence des personnages
2026/08/02

GPT Image 2 + Seedance 2.0 : flux de cohérence des personnages

Concevez un personnage dans GPT Image 2, puis animez ses cadres approuvés avec Seedance 2.0. Six étapes structurées réduisent la dérive entre les plans.

Le flux le plus fiable de GPT Image 2 + Seedance 2.0 sépare la conception de l'identité de l'animation. Concevez et approuvez le personnage d'abord dans GPT Image 2, réutilisez ce même paquet visuel pour créer le cadre de départ de chaque plan, puis demandez à Seedance 2.0 d'animer le cadre au lieu de réinventer la personne à partir du texte.

Cela réduit la dérive des caractères parce que chaque modèle n'a qu'un seul travail. GPT Image 2 contrôle le visage, la silhouette, la garde-robe et le cadrage. Seedance contrôle le mouvement, la caméra, le timing et l'audio. Ce n'est pas une garantie qu'un personnage « ne dérive jamais »—aucune API actuelle n'expose un verrouillage d'identité parfait—mais c'est un flux de travail de production répétable avec des points de contrôle clairs.

Résumé

  • Verrouillez le plan fixe avant de générer le mouvement. Un plan de départ faible ou incohérent devient une vidéo faible.
  • Créez un seul paquet de personnage canonique. Conservez un portrait neutre, une vue de plein corps, une vue à trois-quarts de face et un bloc de texte d'identité écrit court.
  • Générez chaque cadre de plan à partir de ces références gelées. GPT Image 2 sur reAPI accepte jusqu'à 16 URL d'images publiques dans une seule demande image-vers-image.
  • Invitez Seedance à générer du mouvement, pas de l'identité. Transmettez le cadre approuvé et décrivez l'action, la caméra, la cadence et le son.
  • Réutilisez les références sans les échanger en cours de projet. Un nouveau visage « meilleur » au milieu d'une séquence crée une deuxième définition du personnage.
  • Chaînez les clips avec le cadre final retourné. Seedance 2.0 peut retourner un cadre final pour le segment suivant, réduisant les sauts visuels aux jointures.

Pourquoi les personnages dérivent entre les plans vidéo IA

Les descriptions textuelles ne sont pas des enregistrements d'identité. « Une femme aux cheveux noirs courts, aux yeux verts et à la veste rouge » décrit une catégorie contenant des millions de visages possibles. Chaque nouvelle demande texte-vers-vidéo peut échantillonner une autre personne valide tout en respectant les mots.

La dérive entre aussi par des changements qui semblent inoffensifs pour un critique humain :

  • un cadrage différent cache la mâchoire ou les proportions du corps ;
  • des changements d'éclairage dramatiques modifient la couleur apparente des yeux, des cheveux et de la peau ;
  • les invites de garde-robe concurrencent les détails du visage ;
  • une nouvelle référence introduit un nez, un âge ou une coiffure différents ;
  • les instructions de mouvement demandent des rotations ou des occultations que le cadre source ne peut pas supporter.

Seedance 2.0 accepte le texte, les images, l'audio et la vidéo comme modalités de référence, jusqu'à neuf images, trois vidéos et trois clips audio sur sa plateforme ouverte actuelle.[2] Plus de références ne signifient pas automatiquement plus de cohérence. Elles ne fonctionnent que lorsqu'elles sont d'accord.

Le flux de travail de cohérence des personnages en deux étapes

La conception d'identité GPT Image 2 s'écoule vers les vérifications de mouvement et de continuité de Seedance 2.0

Le flux a six portes. N'avancez que lorsque la porte actuelle passe, car réparer l'identité après l'animation est plus lent que régénérer un plan fixe.

1. Rédigez un contrat d'identité

Définissez uniquement les caractéristiques qui doivent survivre à chaque plan. Gardez le bloc assez court pour le coller inchangé dans les invites d'image.

CHARACTER: Mara, fictional adult woman, early 30s
FACE: oval face, wide-set brown eyes, straight nose, small scar above left eyebrow
HAIR: chin-length black bob, center part
WARDROBE: burnt-orange field jacket, charcoal crew-neck shirt
ANCHOR: narrow silver compass pendant
DO NOT CHANGE: age, facial geometry, hair length, scar side, pendant shape

Évitez les étiquettes subjectives telles que « beau », « cool » ou « cinématique ». Ils invitent le modèle à redesigner la personne. Les ancrages physiques sont plus faciles à auditer.

2. Générez le portrait maître dans GPT Image 2

Commencez par un éclairage uniforme, une expression neutre, une géométrie faciale visible et un arrière-plan simple. GPT Image 2 prend en charge la génération et l'édition d'images ; OpenAI documente le texte comme entrée et l'image comme entrée et sortie.[1]

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Character reference portrait. Fictional adult woman, early 30s, oval face, wide-set brown eyes, straight nose, small scar above left eyebrow, chin-length black bob with center part, neutral expression, even soft light, plain warm-gray background, realistic editorial photography, no text",
    "size": "3:4",
    "resolution": "2k"
  }'

Enregistrez l'URL retournée comme portrait canonique. Ne choisissez pas une image de héros dramatique comme maître ; choisissez le visage le plus facile à lire.

3. Développez un portrait en un paquet de référence

Utilisez des demandes image-vers-image avec le portrait approuvé dans image_urls. Générez une vue de plein corps en posture neutre, vues à trois-quarts gauche et droit, et une feuille de garde-robe. Demandez au modèle de préserver l'identité plutôt que de « créer une personne similaire ».

curl https://reapi.ai/api/v1/images/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-image-2",
    "prompt": "Preserve the exact identity, age, facial geometry, scar position, hair cut, jacket, shirt, and compass pendant from the reference. Create a clean full-body character sheet with front and three-quarter views, neutral stance, even studio light, plain background, no labels, no extra people",
    "image_urls": ["https://your-cdn.com/mara-master.png"],
    "size": "16:9",
    "resolution": "2k"
  }'

La route économique gpt-image-2 retourne une image par demande et accepte jusqu'à 16 URL de référence HTTP(S) publiques. Elle n'expose pas une graine ou un identifiant de personnage persistant.[3] La cohérence provient donc de la fourniture répétée des mêmes pixels approuvés.

4. Créez un cadre de départ contrôlé pour chaque plan

Écrivez la liste des plans avant de générer plus d'images. Pour chaque plan, réinjectez le portrait maître et la feuille de personnage dans GPT Image 2, puis modifiez uniquement la scène, la pose, l'objectif et la composition.

Preserve the exact identity and wardrobe from Image 1 and Image 2.
Medium-wide 16:9 frame. Mara stands beside a rain-streaked train window at
night, body at three-quarter angle, face fully visible, compass pendant visible.
Camera at eye level, 50mm lens, soft carriage practical light.
No additional people. Do not change facial geometry, age, hairstyle, scar side,
jacket color, or pendant.

Approuvez le plan fixe par rapport au maître avant de payer son animation. C'est le point le moins cher pour rejeter un visage modifié, une ancre manquante ou une pose incompatible.

5. Animez le cadre avec Seedance 2.0

Transmettez d'abord le cadre du plan approuvé, puis une ou deux références d'identité canoniques si nécessaire. Seedance choisit le mode image-vers-vidéo lorsque image_urls est présent ; il n'y a pas de champ mode séparé sur reAPI.[4]

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.0-face",
    "prompt": "@Image1 remains the same character. She turns slowly toward the rain-streaked window and exhales. Subtle blink, natural breathing, gentle train vibration. Slow 10% camera push-in. Preserve face, black bob, eyebrow scar, orange jacket, and silver compass pendant. No scene cut, no wardrobe change.",
    "image_urls": [
      "https://your-cdn.com/shot-01-start.png",
      "https://your-cdn.com/mara-master.png"
    ],
    "size": "16:9",
    "resolution": "720p",
    "duration": 5,
    "generate_audio": true,
    "return_last_frame": true
  }'

Utilisez une variante Face pour les matériaux source de personne réelle identifiables. Les personnages synthétiques peuvent utiliser une route non Face ou officielle admissible, mais les règles de disponibilité des modèles et de sécurité s'appliquent toujours. Téléchargez uniquement les ressemblances pour lesquelles vous avez le droit et le consentement d'utilisation.

6. Examinez, rejetez et chaînez

Examinez le clip complété image par image. Vérifiez le visage au début, au milieu et à la fin, pas seulement la vignette.

VérificationCondition de réussiteSi elle échoue
Géométrie facialeYeux, nez, mâchoire et âge restent stablesRégénérez à partir du même cadre de départ approuvé
Silhouette des cheveuxLa longueur et la raie restent reconnaissablesRéduisez les rotations de tête ou le mouvement du vent
Ancrages d'identitéCicatrice, pendentif et veste restent présentsRaccourcissez l'invite et réaffirmez les invariants
Mains et occlusionLe visage n'est pas reconstruit après une longue obstructionRéduisez l'occlusion ou divisez l'action
Cadre finalAssez propre pour commencer le plan suivantDemandez une autre prise avant le chaînage

Lorsqu'un clip passe, utilisez output.last_frame_url comme première image de la demande Seedance suivante. Conservez le portrait canonique dans les emplacements de référence restants. Le cadre final protège la continuité spatiale ; le portrait maître protège l'identité.

Règles d'invitation qui réduisent la dérive des caractères

L'ordre des instructions importe. Une invite de mouvement Seedance utile suit cette séquence :

identity binding → action → camera → environment motion → audio → invariants

Par exemple :

@Image1 remains the same character. She takes two measured steps toward the
door and looks over her left shoulder. Handheld camera tracks backward at chest
height. Curtains move slightly in the draft; quiet room tone and footsteps.
Preserve face, age, black bob, eyebrow scar, orange jacket, and pendant. No cut,
no new person, no costume change, no extreme motion blur.

Ne répétez pas une longue description visuelle qui entre en conflit avec le cadre fourni. Le cadre définit déjà la scène. L'invite devrait dépenser la plupart de ses tokens sur le changement au fil du temps.

Quoi ne pas faire

Cinq raccourcis courants aggravent la dérive.

  1. Ne générez pas chaque plan à partir du texte. Chaque demande échantillonne une nouvelle personne.
  2. Ne remplacez pas le maître après le plan trois. Fixez un mauvais plan, pas l'identité canonique.
  3. Ne mélangez pas les références de générations différentes. Les petits désaccords dans le visage ou les vêtements deviennent des instructions conflictuelles.
  4. Ne demandez pas de mouvement extrême immédiatement. Testez un clignotement, un petit tour ou une courte marche avant les rotations, les pirouettes, les foules et une occlusion importante.
  5. N'utilisez pas un cadre final dérivé comme seule prochaine référence. Appariez-le avec le maître propre ou régénérez la transition.

Le guide de cohérence des personnages de Seedance 2.0 couvre l'ordre des références, la réutilisation de la voix, les invites multi-plans et les chaînes plus longues en plus de détails.

Stratégie de coût et d'itération

Ce flux coûte moins cher lorsque les défaillances sont détectées au stade de l'image fixe. Une demande GPT Image 2 produit un candidat, tandis que Seedance facture les vidéos par durée de sortie et résolution. La vidéo de référence téléchargée peut également ajouter des secondes facturables ; les références d'images ne le font pas.[3][4]

Une boucle de production disciplinée est :

  1. Générez des brouillons de caractères 1K ou 2K avec peu de tentatives.
  2. Approuvez un maître et arrêtez l'exploration de l'identité.
  3. Générez et examinez chaque cadre de départ comme un plan fixe.
  4. Animez des tests de 720p de cinq secondes avec un mouvement simple.
  5. Augmentez la durée ou la résolution uniquement après que l'invite passe.

Les tarifs actuels peuvent changer, donc calculez le budget à partir des pages en direct du modèle GPT Image 2 et du modèle Seedance 2.0 plutôt que de copier une figure ancienne par image ou par seconde dans une feuille de calcul de production. Le guide du coût par seconde de Seedance explique les dimensions de facturation.

Une structure de dossier réutilisable

Traitez la cohérence des personnages comme la gestion des actifs, pas la chance de l'invite.

project/
  character/
    identity-contract.txt
    master-portrait.png
    character-sheet.png
    approved-refs.json
  shots/
    01-train-window/
      start-frame.png
      motion-prompt.txt
      output.mp4
      last-frame.png
    02-platform/
      start-frame.png
      motion-prompt.txt

Versionnez le contrat d'identité et les URL de référence. Si le directeur artistique approuve une véritable refonte, créez un paquet de personnage v2 et régénérez tous les plans dépendants au lieu de mélanger les versions.

FAQ

GPT Image 2 + Seedance 2.0 garantit-il zéro dérive de caractères ?

Non. Cela réduit la dérive en ancrant chaque plan à des images approuvées, mais aucune API n'expose un verrouillage de caractère persistant parfait. Le mouvement, l'occlusion, les références conflictuelles et les longs clips peuvent toujours modifier l'identité.

Combien de références de personnage dois-je utiliser ?

Commencez par le cadre du plan approuvé plus un portrait maître. Ajoutez une feuille de personnage uniquement lorsqu'elle contribue un angle manquant ou des informations de plein corps. Le maximum de l'API n'est pas un objectif.

Le portrait maître de GPT Image 2 devrait-il être cinématique ?

Non. Utilisez un éclairage uniforme, une expression neutre, un visage visible et un arrière-plan simple. Construisez l'éclairage cinématique dans chaque cadre de plan après l'approbation de l'identité.

Quel modèle de Seedance 2.0 dois-je utiliser pour une personne réelle ?

Utilisez une variante Face qui accepte les entrées de personne réelle identifiables et confirmez que vous avez le consentement et les droits d'utilisation. Les routes officielles/non Face peuvent rejeter de telles références.[4]

Puis-je réutiliser le cadre final de Seedance pour le clip suivant ?

Oui. Définissez return_last_frame: true, puis transmettez l'URL retournée dans la demande suivante. Conservez la référence maître originale à côté pour que les petites erreurs ne se cumulent pas sur la séquence.

Dois-je ajouter des invites négatives comme « pas de dérive faciale » ?

Les invariants brefs peuvent aider, mais la qualité des références et le mouvement réalisable importent davantage. Un cadre de départ propre plus une petite action visible est plus fort qu'une longue liste de termes négatifs.

Le flux de travail vidéo IA à cohérence de caractères en une phrase

GPT Image 2 définit et prépare le personnage ; Seedance 2.0 anime des cadres approuvés ; une porte d'examen humain empêche un plan dérivé de contaminer le suivant. C'est le flux de travail pratique de cohérence des caractères GPT Image 2 + Seedance 2.0 — pas une promesse d'identité parfaite, mais un flux contrôlé qui peut être répété, mesuré et amélioré.

Pour un aperçu plus large de la génération d'images, lisez Comment utiliser GPT Image 2. Pour les références Seedance au-delà des personnages, consultez la documentation de l'API de Seedance 2.0.

Références

  1. OpenAI. GPT Image 2 model documentation — image generation and editing, modalities, endpoints, and snapshots. Retrieved August 2, 2026. developers.openai.com/api/docs/models/gpt-image-2
  2. Team Seedance et al. Seedance 2.0: Advancing Video Generation for World Complexity. April 2026. arxiv.org/abs/2604.14148
  3. reAPI. GPT Image 2 API documentation — reference limits, resolutions, and async task behavior. Retrieved August 2, 2026. reapi.ai/docs/gpt-image-2
  4. reAPI. Seedance 2.0 API documentation — mode routing, reference limits, variants, last-frame return, and billing. Retrieved August 2, 2026. reapi.ai/docs/seedance-2-0
  5. Devenko AI. GPT Image 2.0 + Seedance 2.0: The Only Workflow Where Your Character Never Drifts. July 2026. devenkoai.medium.com