
Diriger des acteurs IA naturels avec une feuille de jeu
Planifiez des scènes dialoguées IA crédibles : battements dramatiques, états de personnage, progression caméra, invites structurées et révision.
Une direction d'acteur IA crédible commence par une feuille de jeu, non par une liste d'émotions interminable. Une feuille de jeu transforme une scène en petits changements que le modèle peut montrer : un personnage entend une réplique, marque une pause, regarde ailleurs, prend une décision, puis parle. Elle définit également l'état visible à la fin de chaque battement, de sorte que le moment suivant ait un point de départ concret.
Ce tutoriel pour débutants construit une courte scène dialoguée, de l'idée à la révision. Vous pouvez appliquer cette méthode avec n'importe quel modèle vidéo acceptant des invites détaillées. L'exemple d'API utilise Seedance 2.5 sur reAPI car il prend en charge l'audio généré et les clips jusqu'à 30 secondes en une seule demande.[1]
Résumé
- Écrivez une phrase décrivant ce qui change émotionnellement dans la scène.
- Donnez à chaque personnage un état stable de départ, un objectif privé et un point de pression.
- Divisez la scène en battements contenant chacun approximativement une action ou une réaction.
- Terminez chaque battement par un état observable : regard, posture, distance, accessoire ou expression.
- Placez le dialogue, la performance, la mise en place, la caméra et le son dans des blocs d'invites séparés.
- Avant d'accepter le clip, révisez l'assignation des interlocuteurs, les pauses, le regard, les mains, la direction écran et l'état final.

Qu'est-ce qu'un battement dramatique
Un battement dramatique est le plus petit changement significatif dans une scène. Ce n'est pas simplement une plage de temps. Quelque chose doit changer dans ce qu'un personnage sait, veut ou fait.
Considérez cette ligne :
Maya: "You already packed?"« Maya semble triste » est une direction faible car elle décrit une humeur générale. Un battement est plus utile :
Maya notice la valise avant de parler. Ses épaules cessent de bouger. Elle regarde
la valise, puis Leo, et demande doucement, "You already packed?" Elle termine le
battement en maintenant le contact visuel, attendant sa réponse.La deuxième version fournit au modèle un déclencheur, une séquence, une interprétation de la réplique et un état final. Ce sont des instructions visibles plutôt qu'un label abstrait.
Étape 1 : réduire la scène à un changement émotionnel
Avant d'écrire le dialogue, complétez cette phrase :
La scène commence avec __________ et se termine avec __________ parce que __________.Par exemple :
La scène commence avec Maya s'attendant à un adieu normal et se termine avec
elle réalisant que Leo avait l'intention de partir sans le lui dire, parce
qu'elle voit sa valise préparée avant qu'il ne puisse la cacher.C'est l'épine dorsale de la scène. Si un mouvement de caméra proposé, un geste ou une ligne supplémentaire n'aide pas le spectateur à comprendre ce changement, supprimez-le. Les débutants demandent souvent une génération qui porte plusieurs rebondissements émotionnels, une révélation de lieu, un placement de produit et une chorégraphie caméra compliquée. Le modèle distribue alors son attention sur trop de tâches.
Commencez par un changement. Ajoutez de la complexité seulement après que la version simple fonctionne.
Étape 2 : rédiger une fiche d'état de personnage compacte
Un modèle n'a pas besoin d'une page de biographie. Il a besoin des détails qui affectent cette scène.
{
"maya": {
"starting_state": "relaxed, expecting a routine goodbye",
"goal": "get an honest explanation",
"pressure_point": "being excluded from important decisions",
"default_behavior": "stays quiet before confronting someone",
"fixed_visuals": "dark bob, green coat, silver watch"
},
"leo": {
"starting_state": "guarded and eager to leave",
"goal": "end the conversation without admitting guilt",
"pressure_point": "direct eye contact",
"default_behavior": "handles nearby objects when uncomfortable",
"fixed_visuals": "short brown hair, charcoal jacket, black suitcase"
}
}Le champ default_behavior est particulièrement utile. « Nervous » peut devenir des clignements aléatoires et des mouvements faciaux exagérés. « Tourne la poignée de la valise quand il est mal à l'aise » donne à la performance une issue physique.
Si la ressemblance compte, préparez des images de référence claires avant la génération. Ce tutoriel se concentre sur la planification de la performance ; le flux de travail de cohérence de caractère couvre la préparation des références plus en détail.
Étape 3 : transformer le dialogue en battements chronométrés
Utilisez quatre à six battements pour une courte scène. Les secondes exactes sont des guides, non des décisions de montage précises à la trame. Ce qui compte, c'est l'ordre et un état final clair.
| Heure | Déclencheur | Performance visible | Dialogue | État final |
|---|---|---|---|---|
| 0–4 s | Maya voit la valise | La marche s'arrête ; les yeux se déplacent vers la valise | Aucun | Maya immobile, valise entre eux |
| 4–8 s | Leo la remarque | La main se resserre sur la poignée ; évite le contact visuel | Maya : "You already packed?" | Leo regarde vers la porte |
| 8–13 s | Le silence devient inconfortable | Maya se rapproche ; Leo expire | Leo : "It was easier this way." | Les deux restent en position |
| 13–19 s | Maya comprend | Un coup d'œil vers le bas, puis un contact visuel régulier | Maya : "For who?" | Maya calme ; Leo acculé |
| 19–24 s | Leo ne peut pas répondre | La main quitte la poignée ; la posture s'adoucit | Aucun | Silence, pas de réconciliation |
Remarquez que pas chaque battement ne contient de la parole. Le silence donne au modèle le temps de montrer une réaction. Cela rend également l'assignation du locuteur plus claire que le dialogue chevauchant continu.
Étape 4 : planifier la mise en place avant le mouvement de caméra
La mise en place décrit où les gens et les objets sont. La direction de la caméra décrit comment le public voit cette mise en place. Réglez la première avant d'ajouter la deuxième.
Pour la scène d'exemple :
- Maya commence à gauche du cadre, à deux mètres de la valise.
- Leo commence à droite du cadre avec sa main droite sur la poignée.
- La valise reste entre eux.
- Ni l'un ni l'autre ne franchit la ligne du centre.
- Maya fait un pas en avant pendant le troisième battement.
- Leo ne s'éloigne pas avant le battement final.
Ces contraintes protègent la direction écran et faciliteront les coupes ultérieures. Puis ajoutez une simple progression de caméra :
0-8 s : plan moyen fixe, deux plans.
8-19 s : très lent déplacement vers un plan double plus serré.
19-24 s : tenir. Aucun mouvement de caméra supplémentaire.Ne faites pas que la caméra exécute chaque émotion. Un orbite soudain, un mouvement de grue et un zoom peuvent rivaliser avec les acteurs. Pour un test de dialogue, un mouvement retenu suffit.
Étape 5 : assembler l'invite en six blocs
Les blocs d'invites séparés rendent les erreurs plus faciles à diagnostiquer. Si la caméra est mauvaise, vous pouvez modifier le bloc caméra sans réécrire l'identité du personnage ou le dialogue.
REFERENCES
Image 1 is Maya's identity and wardrobe reference. Image 2 is Leo's identity
and wardrobe reference. Image 3 defines the station entrance, lighting, and
initial blocking.
CHARACTERS
Maya stays quiet before confronting someone. Leo handles the suitcase when he
is uncomfortable. Preserve their age, facial features, hair, clothing, and
body proportions throughout.
SCENE AND BLOCKING
Evening outside a train station. Maya remains frame left. Leo remains frame
right. A black suitcase stays between them. They do not cross positions.
PERFORMANCE TIMELINE
0-4s: Maya enters, notices the suitcase, stops walking, and looks from the
suitcase to Leo. End with Maya still and Leo unaware.
4-8s: Leo notices her and tightens his hand on the handle without looking at
her. Maya asks quietly, "You already packed?" End with Leo looking at the door.
8-13s: Maya takes one step closer. Leo exhales and says, "It was easier this
way." End with both holding position.
13-19s: Maya briefly looks down, regains eye contact, and asks, "For who?"
End with Maya calm and Leo unable to answer.
19-24s: Leo releases the handle and softens slightly. Neither speaks. End in
unresolved silence.
CAMERA
0-8s locked medium two-shot. 8-19s very slow push to a tighter two-shot.
19-24s hold. Keep both faces visible and preserve the left-right axis.
SOUND AND CONSTRAINTS
Natural American English. Keep the exact lines and speaker assignment. Quiet
station ambience. No narration, subtitles, extra dialogue, background music,
or exaggerated crying.ByteDance documente que Seedance peut référencer la composition, le mouvement, le langage de la caméra et le son à partir d'entrées multimodales. Il note également que le modèle a encore de la place pour s'améliorer sur la cohérence multi-sujets et la précision du texte, c'est pourquoi les rôles de référence et l'étape de révision comptent.[2]
Étape 6 : générer une répétition avant la scène finale
Utilisez une répétition courte et à faible risque pour tester l'ordre du locuteur, la mise en place et le chronométrage émotionnel. Ne jugez pas encore la texture du costume ou la couleur finale.
Sur reAPI, une demande Seedance 2.5 minimale ressemble à ceci :
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "PASTE_THE_SIX_BLOCK_PROMPT_HERE",
"image_urls": [
"https://example.com/maya.jpg",
"https://example.com/leo.jpg",
"https://example.com/station.jpg"
],
"resolution": "720p",
"size": "16:9",
"duration": 24,
"generate_audio": true
}'La demande est asynchrone. Interrogez l'ID de tâche retourné jusqu'à ce que le statut soit completed ou failed. Les limites de champ actuels et les règles de facturation figurent dans la documentation de l'API Seedance 2.5, non dans les hypothèses client codées en dur.
Étape 7 : réviser la performance dans le bon ordre
Regardez le résultat trois fois avec un objectif différent à chaque fois.
Passage un : son uniquement
Écoutez sans regarder. Vérifiez les répliques exactes, l'assignation du locuteur, l'ordre des répliques, la narration indésirable, le rythme et si les pauses existent où la feuille de jeu les demande.
Passage deux : image sans son
Désactivez le son du clip. Vérifiez le regard, la position du corps, le comportement des mains, la continuité du visage, la direction écran et si chaque battement se termine dans l'état prévu.
Passage trois : scène complète
Jugez maintenant si le dialogue, la réaction, la caméra et le son soutiennent le même rebondissement. Si une couche échoue, réparez d'abord cette couche. Ne réécrivez pas toute la scène parce qu'une pause est trop courte.
Utilisez une simple feuille d'acceptation :
{
"speaker_order": "pass",
"exact_dialogue": "pass",
"left_right_axis": "pass",
"beat_3_end_state": "repair",
"identity": "pass",
"camera": "pass",
"repair_note": "Leo looks at Maya too early; hold gaze on the door through 13s"
}C'est le même principe que la boucle de critique vidéo IA : accepter ou réparer en fonction de preuves explicites plutôt que de demander si le clip « semble bon ».
Erreurs courantes des débutants
| Erreur | Pourquoi ça échoue | Meilleur mouvement |
|---|---|---|
| Écrire « triste, cinématique, émotionnel » | Les mots d'humeur ne définissent pas le comportement | Ajouter un déclencheur, une réaction physique et un état final |
| Donner aux deux personnages un mouvement constant | La scène devient animée et peu claire | Laisser un agir tandis que l'autre reçoit |
| Remplir chaque seconde de dialogue | Les réactions n'ont pas de temps pour s'enregistrer | Réserver des battements pour le silence |
| Changer le style de caméra à chaque battement | La caméra rivalise avec la performance | Utiliser une progression et une tenue |
| Régénérer tout après un défaut | Les bonnes parties sont perdues | Réparer le bloc défaillant le plus petit |
| Demander du texte de marque exact à l'intérieur de la scène | Le texte généré peut être peu fiable | Ajouter la copie critique en post-production |
FAQ
Combien de battements dramatiques un débutant devrait-il utiliser ?
Commencez par quatre à six. Chaque battement devrait contenir un déclencheur ou une réaction principale. Si une ligne a besoin de plusieurs phrases pour expliquer ce qui change, divisez-la.
Les codes temporels garantissent-ils un chronométrage exact ?
Non. Traitez-les comme une indication de cadence. Vérifiez le résultat rendu et coupez dans un éditeur lorsque le chronométrage de livraison exact compte.
Chaque émotion doit-elle être visible sur le visage ?
Non. La posture, le regard, la distance, le mouvement des mains et le silence communiquent souvent plus clairement qu'une expression exagérée.
Puis-je utiliser ce flux de travail sans images de référence de personnage ?
Oui, mais l'identité visuelle sera moins contrainte. Les références deviennent plus importantes quand une personne spécifique ou un personnage fictif récurrent doit rester reconnaissable.
Que dois-je corriger en premier quand une scène dialoguée échoue ?
Réparez l'ordre du locuteur et la mise en place avant l'émotion subtile. Une réaction magnifiquement rendue ne peut pas sauver une scène où le mauvais personnage parle ou se déplace du mauvais côté.
Conclusion
Une feuille de jeu de direction d'acteur IA convertit une idée émotionnelle en travail observable : déclencheurs, réactions, dialogue, mise en place, états finaux et critères de révision. Construisez un simple changement, donnez de l'espace au silence et maintenez la caméra retenue. Une fois que cette version fonctionne, vous pouvez ajouter des performances plus complexes sans perdre le contrôle de la scène.
References
- ByteDance Seed. One-take Creation, Flexible Referencing: Introducing Seedance 2.5. July 31, 2026. seed.bytedance.com
- ByteDance Seed. Seedance 2.0 Official Launch. February 12, 2026. seed.bytedance.com
- reAPI. Seedance 2.5 API — Parameters, Modes & Billing. Retrieved August 27, 2026. reapi.ai
Auteur

Catégories
Plus d'articles

Cinq images publicitaires produit avec n8n sous 0,20 $
Convertir un test validé de génération d'images publicitaires produit à 0,075 $ en workflow n8n, avec polling borné, budget de retry et checklist de révision.


API Seedance 2.5 : tarifs comparés sur quatre plateformes
Tarifs Seedance 2.5 sur reAPI, fal, kie et WaveSpeed en août 2026. Écart de 1,8 fois, facturation variable avec vidéo source, trois cas pratiques.


Qu’est-ce que Seedance 2.0 et comment l’utiliser ? Guide 2026
Découvrez Seedance 2.0, ses vrais sites officiels, toutes les plateformes disponibles et l’appel API. Informations vérifiées en juillet 2026.
