
De Seedream à Seedance : flux du transfert de cadre clé
Le flux Seedream Seedance stabilise la composition par image, puis transfère le cadre à la vidéo. Répartition des tâches et pièges essentiels.
La génération de texte à vidéo a un problème structurel qu'aucune invite ne peut résoudre : changer un détail réécrit toute la scène. Ajustez l'éclairage et le visage du personnage se décale. Corrigez le visage et l'arrière-plan bouge. Chaque itération est un nouveau lancer.
La solution consiste à arrêter de demander à un modèle de faire deux tâches. Verrouillez d'abord la image avec un modèle d'image, puis transmettez cette image approuvée au modèle vidéo comme référence. C'est le flux de travail Seedream Seedance, et sa valeur n'est pas une qualité de génération plus élevée. C'est que l'approbation devient durable.
Résumé
- Deux phases, deux modèles. Seedream 5.0 Pro établit à quoi ressemble la scène. Seedance gère le mouvement.
- La transmission est une image de référence, pas une redescription. L'image approuvée est passée dans
image_urls. - Seedream accepte jusqu'à 10 références avec édits ancrés et typographie multilingue en 2K.
- Itérez bon marché sur l'image fixe, où une régénération coûte quelques centimes et secondes plutôt que des dollars et des minutes.
- Approuvez le mouvement avant les détails. Une fois que le mouvement de caméra est correct, les corrections restantes sont locales.
- Certaines prétentions de flux stratifiés ne survivent pas à la vérification. Nous les avons examinées séparément dans ce qui est réellement livré.
Pourquoi le découplage fonctionne

Une génération vidéo est coûteuse dans les deux sens : elle coûte plus par appel qu'une image, et elle prend assez longtemps pour qu'un mauvais résultat gaspille du temps réel. Pousser chaque décision créative à travers cette boucle est la raison pour laquelle les équipes signalent brûler la plupart de leur calendrier sur les retouches.
Le fractionnement du pipeline change ce que coûte chaque itération.
La phase un est bon marché et rapide. Composition, éclairage, géométrie du produit, typographie, couleur de marque. Ce sont des décisions image fixe, et les établir sur un modèle d'image signifie que chaque tentative coûte quelques cents et revient en secondes.
La phase deux hérite d'une image établie. La génération de mouvement part de quelque chose déjà approuvé plutôt que de redériver la scène à partir d'un paragraphe. Moins de variables bougent, donc moins de choses se cassent.
L'argument économique est direct : l'appel cher devrait s'exécuter une fois, après que les appels bon marché aient supprimé l'incertitude.
Phase un : établir le cadre
Seedream 5.0 Pro est l'étape d'actif. Ce qui importe pour la transmission :
Jusqu'à 10 images de référence avec édits ancrés, afin qu'un produit ou un personnage puisse être épinglé plutôt que décrit.
Typographie multilingue en 2K, préservant la couleur et la mise en page exactes, ce qui importe quand l'image porte du texte de marque qui doit survivre dans la vidéo.
Facturation basée sur le budget de pixels, divisée à 2,36M pixels. Un cadre 16:9 à 2048×1152 s'insère dans le niveau moins cher, ce qui est la bonne taille pour la plupart des cadres clés de toute façon. Les détails dans la ventilation des prix.
La sortie de cette phase n'est pas un dossier d'options. C'est un cadre approuvé par coup, plus l'invite qui l'a produit.
curl https://reapi.ai/api/v1/images/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedream-5-0-pro",
"prompt": "product hero on a stone counter, soft window light from camera left, brand wordmark legible on the label",
"image_urls": ["https://example.com/packshot.jpg"],
"size": "2048x1152"
}'Phase deux : transmettre l'image
La transmission est la partie que les gens font mal. L'instinct consiste à redécrire l'image approuvée dans l'invite vidéo. Cela réintroduit exactement l'ambiguïté que la phase un a supprimée.
Transmettez l'image elle-même :
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "seedance-2-5",
"prompt": "0-5s: [locked medium] no camera movement, steam rises from the cup. 5-12s: [slow dolly in] 0.3 m/s, product stays centered. Do not add text or logos.",
"image_urls": ["https://cdn.example.com/approved-keyframe.png"],
"resolution": "1080p",
"duration": 12
}'Notez ce que l'invite vidéo fait et ne fait pas. Elle décrit le mouvement et les contraintes. Elle ne redécrit pas l'éclairage, la composition ou le produit, car l'image de référence porte déjà ceux-ci.
Cette division est la discipline. Tout ce qui est visible dans le cadre clé appartient au cadre clé, pas à l'invite de mouvement.
Ce que chaque phase gère
| Décision | Phase | Raison |
|---|---|---|
| Composition et cadrage | Image | Bon marché à itérer, cher à corriger en mouvement |
| Direction d'éclairage | Image | Dérive si seulement décrite dans une invite vidéo |
| Géométrie et logo du produit | Image | Ancrés par référence plutôt que générés |
| Typographie et texte de marque | Image | Où le rendu de texte est le plus fort |
| Trajectoire et vélocité de caméra | Vidéo | Le mouvement est le travail du modèle vidéo |
| Timing et temps | Vidéo | La structure horodatée appartient au mouvement |
| Contraintes négatives | Les deux | La suppression de texte importe dans chaque phase |
Les lignes qui génèrent la plupart des confusions sont l'éclairage et le cadrage. Tous deux semblent appartenir à l'invite vidéo car c'est d'où vient la sortie finale. Les y mettre signifie les redécider à chaque génération.
D'où viennent réellement les économies
Les prétentions de 60 % d'itération plus rapide qui flottent autour de ce flux de travail sont des chiffres de marketing, pas des mesures. Le mécanisme en dessous est réel cependant, et il vaut la peine d'être énoncé clairement plutôt que sous forme de pourcentage.
Une image rejetée coûte une génération d'image. Une vidéo rejetée coûte une génération vidéo plus l'attente.
Une image approuvée est réutilisable. Le même cadre clé peut conduire plusieurs variantes de mouvement, durées différentes, mouvements de caméra différents, sans régénérer la scène.
Les édits locaux restent locaux. Corriger un point culminant sur le cadre clé ne perturbe pas un mouvement de caméra que vous avez déjà approuvé, car le mouvement n'a pas encore été généré.
Ce troisième point est celui que les équipes découvrent tard. L'ordonnancement de l'approbation pour que les décisions bon marché soient d'abord établies n'est pas un hack de productivité, c'est ce qui rend le coup cher digne d'être fait.
Où le pipeline se casse
Redécrire l'image dans l'invite vidéo. L'erreur la plus courante. Cela donne au modèle vidéo la permission de réinterpréter ce qui avait déjà été établi.
Approuver un cadre clé au mauvais rapport d'aspect. Générez l'image au rapport d'aspect que la vidéo utilisera. Recadrer un cadre clé 1:1 dans un shot 16:9 réintroduit les décisions de cadrage.
Ignorer l'image pour les shots « simples ». Les shots simples sont exactement l'endroit où l'image est la moins chère, donc le ratio d'économies est le plus élevé.
Traiter la référence comme une suggestion. Si la sortie s'écarte du cadre clé, ajoutez des contraintes explicites liant la vidéo à celui-ci plutôt que de réécrire la description.
FAQ
Pourquoi utiliser deux modèles au lieu d'un appel texte à vidéo ?
Parce qu'un appel texte à vidéo redérive l'ensemble de la scène à chaque fois, donc changer un détail change tout. Établir l'image en premier rend l'approbation durable à travers les itérations.
Qu'est-ce qui est exactement transmis entre les phases ?
Le cadre clé approuvé en tant qu'image de référence, plus une invite de mouvement. La description visuelle n'est pas répétée.
L'invite vidéo doit-elle décrire l'éclairage ?
Non. Tout ce qui est visible dans le cadre clé appartient au cadre clé. L'invite de mouvement couvre la trajectoire de caméra, le timing et les contraintes.
Quel devrait être le rapport d'aspect du cadre clé ?
Celui que la vidéo utilisera. Générer une image à un rapport différent et recadrer réintroduit la décision de cadrage que vous avez déjà prise.
Un cadre clé peut-il conduire plusieurs vidéos ?
Oui, et c'est beaucoup de la valeur. Des durées, des mouvements de caméra et des réductions différentes peuvent partager un cadre approuvé sans régénérer la scène.
Cela fonctionne-t-il pour les séquences multi-shots ?
Oui. Approuvez un cadre clé par shot, puis générez le mouvement de chaque shot à partir de sa propre référence. La cohérence entre les shots provient des images fixes partageant des références, pas d'une seule longue invite.
Les prétentions de sortie stratifiée sur ce flux de travail sont-elles exactes ?
Plusieurs spécifications largement répétées ne survivent pas à une vérification par rapport aux tableaux de capacité officiels. Nous les avons vérifiées dans ce qui est réellement livré.
Ordonnancer l'approbation, pas seulement la génération
Le flux de travail Seedream Seedance est décrit comme une technique de qualité, et ce n'est pas vraiment. Les deux modèles produisent ce qu'ils produisent, que vous les enchaîniez ou non.
Ce que l'enchaînement change, c'est l'ordre dans lequel les décisions deviennent finales. La composition, l'éclairage et le détail de marque sont établis sur une surface où se tromper ne coûte que quelques centimes. Le mouvement est généré une fois, par rapport à une image dont personne ne débat toujours. Le pipeline vaut la peine d'être construit pour cette seule raison, et les équipes qui signalent les plus grands gains sont celles qui ont avancé l'approbation plus tôt, pas celles qui ont trouvé une meilleure invite.
Références
- Volcano Engine. Familles de modèles Seedream et Seedance. Consulté en juillet 2026 depuis volcengine.com
Lectures complémentaires
- reAPI. Flux de travail Seedream 5.0 Pro Seedance 2.5 : ce qui est réellement livré. reapi.ai/blog/seedream-5-0-pro-seedance-2-5-workflow
- reAPI. Contrôle de caméra Seedance 2.5. reapi.ai/blog/seedance-2-5-camera-control
- reAPI. Prix Seedream 5.0 Pro. reapi.ai/blog/seedream-5-0-pro-price
Auteur

Catégories
Plus d'articles

L'API Midjourney : options sans Discord avec V8.2
Midjourney dispose-t-il d'une API publique ? Réponse officielle, changements de V8.2, risques de l'automation, et comment évaluer les options d'API.


Comment utiliser Nano Banana 2 Lite : vitesse, prix et limites
Nano Banana 2 Lite : générer des images 1K en quatre secondes, étalonnages officiels, calculs de coûts exacts, plafond de résolution et techniques de prompt.


Préviz caméra Blender pour générer des vidéos IA
Construisez une scène grise dans Blender, animez un chemin de caméra réutilisable et exportez un aperçu pour guider la génération de vidéo IA.
