Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 par seconde
Vidéos longues IA: enchaînage au-delà du plafond
2026/08/09

Vidéos longues IA: enchaînage au-delà du plafond

Maximum 30 secondes par génération IA. Enchaîner les segments sans joint, règles de paramètres, ruptures visibles, et coût pour trois minutes de vidéo.

Chaque modèle de vidéo IA limite une génération unique à bien moins d'une minute. Seedance 2.5 s'arrête à 30 secondes, Seedance 2.0 et MiniMax H3 à 15, et Veo 3.1 est fixe à 8.[1][2][3][4] Il n'y a aucun paramètre qui dépasse ces plafonds, et aucune générateur vidéo IA longs videos cachée derrière un forfait payant. La limite est architecturale.

Donc chaque vidéo IA de plusieurs minutes que tu as jamais vue a été assemblée à partir de segments. La question qui vaut la peine d'être répondue n'est pas quel modèle fait de longs vidéos, c'est comment joindre des segments sans que la jonction soit visible, ce que cela coûte quand tu comptes les segments que tu jettes, et quelles combinaisons de paramètres deviennent silencieusement illégales dès que tu commences l'enchaînage. Ceci couvre tous les trois, en utilisant l'API plutôt qu'un éditeur de chronologie.

TL;DR

  • 30 secondes est le plafond actuel d'un seul appel, sur Seedance 2.5.[1] Chaque flux de travail générateur vidéo IA longs videos au-delà de ce point est des segments enchaînés.
  • return_last_frame est la jonction. Demande-le, puis alimente output.last_frame_url dans l'appel suivant comme la première image.[1]
  • L'enchaînage force size: adaptive. Une tâche de première image rejette tout autre rapport d'aspect à la soumission, alors choisis ton cadrage dans le segment un.[1]
  • Un segment enchaîné ne peut pas aussi porter une vidéo de référence. image_with_roles s'exclut mutuellement avec video_urls et audio_urls.[1]
  • Une pièce 720p de trois minutes coûte environ $48 de génération si rien n'est rejeté, et plus proche de $144 à trois tentatives par segment.[5]

Pourquoi aucun mode générateur vidéo IA longs videos n'existe

Limites publiées, à partir de la référence des paramètres de chaque modèle:

ModèleDurée d'un seul appel
Seedance 2.54–30 s, ou -1 pour laisser le modèle choisir[1]
Seedance 2.04–15 s[2]
MiniMax H34–15 s, défaut 6[3]
Grok Imagine 1.51–15 s[6]
Veo 3.1fixe à 8 s en amont[4]

Trente secondes est le meilleur disponible, et c'est récent. Traite toute affirmation de générateur vidéo IA longs videos comme soit l'enchaînage en ton nom, soit la description de quelque chose d'autre qu'une génération continue.

Cette distinction est importante pour le coût. Un outil qui enchaîne pour toi paie toujours pour chaque segment, et toi aussi.

La chaîne: dernière image dehors, première image dedans

Le mécanisme est deux champs. Définis return_last_frame: true sur une génération et la tâche complétée porte output.last_frame_url aux côtés de la vidéo.[1] Passe cette URL à l'appel suivant comme une première image et le deuxième clip démarre au pixel exact où le premier s'est terminé.

Segment un, établissant le cadrage pour toute la pièce:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "Wide shot, harbour at dawn, slow push in",
    "resolution": "720p",
    "size": "16:9",
    "duration": 30,
    "return_last_frame": true
  }'

Segment deux et au-delà, commençant par l'image précédente:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer rk_live_your_key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedance-2.5-face",
    "prompt": "The camera continues past the moored boats toward the market",
    "resolution": "720p",
    "duration": 30,
    "return_last_frame": true,
    "image_with_roles": [
      { "url": "https://cdn.reapi.ai/media/tasks/.../0.png", "role": "first_frame" }
    ]
  }'

Remarque ce qui a disparu de la deuxième requête. Il n'y a pas de size.

Trois règles qui ne mordent que quand tu enchaînes

Les segments enchaînés doivent fonctionner de manière adaptative. Une requête portant image_with_roles n'accepte que size: "adaptive" ou aucun size du tout; toute autre chose est rejetée à la soumission plutôt que des minutes plus tard.[1] Ce n'est pas arbitraire, la sortie suit la géométrie de la première image, qui est exactement le comportement que la continuité exige. La conséquence pratique est que le segment un décide du rapport d'aspect pour toute la pièce, alors fais-le correctement avant de générer 6 autres.

Un segment enchaîné ne peut pas porter de vidéo ou d'audio de référence. image_with_roles s'exclut mutuellement avec à la fois video_urls et audio_urls.[1] Si un plan au milieu de la séquence a besoin d'une référence de mouvement, ce plan ne peut pas aussi être enchaîné par images. Choisis un par segment.

image_urls et image_with_roles ne peuvent pas être combinés. Les images de référence de personnages et l'enchaînage d'images sont des modes séparés.[1] Pour une séquence enchaînée avec un personnage récurrent, porte le personnage à travers l'image elle-même plutôt que par les images de référence.

Ces trois contraintes sont appliquées avant la soumission, ce qui est le bon cas. Tu obtiens un 400 en une seconde plutôt qu'une tâche échouée en quatre minutes.

Où les chaînes se cassent vraiment

La continuité des images n'est pas la continuité des scènes. La jonction est parfaite au pixel et la dérive se manifeste ailleurs.

La couleur et l'exposition changent. Chaque segment dérive sa propre note à partir d'une seule image. Sur six segments, la séquence peut s'éloigner sensiblement même si chaque jonction individuelle est parfaite. Évalue le montage assemblé, pas les segments.

Discontinuité de mouvement à la couture. Une image figée n'a pas de vélocité. Si le segment un se termine au milieu d'un panoramique, le segment deux commence à partir d'une image statique et doit rétablir le mouvement, ce qui se lit comme un bégaiement. Écris les finales de segments qui arrivent au repos, ou accepte une coupe sur la jonction et traite-la comme un changement de plan plutôt qu'une continuation.

L'audio n'enchaîne pas. Chaque génération synthétise sa propre piste. Six segments te donnent six pistes audio indépendantes, et les coutures sont plus audibles que les visuelles. Pour tout ce qui dure plus d'environ une minute, génère sans audio et place une seule piste sur le montage assemblé.

Dérive d'identité chez les personnes. Un visage reconstruit à partir d'une seule image chaque fois accumule l'erreur. C'est là qu'une séquence enchaînée se trahit généralement en premier.

Aucun de ces éléments ne peut être corrigé en invitant plus dur. Ce sont les propriétés du redémarrage d'une génération à partir d'une image fixe, et la réponse pratique est de concevoir la pièce pour que ses coupes tombent là où se trouvent les coutures.

Ce que trois minutes coûtent vraiment

180 secondes à 720p sur Seedance 2.5 c'est six segments de 30 secondes. Au tarif publié de $0.266824 par seconde:[5]

Tentatives par segmentTotal secondes généréesCoût
1 (rien rejeté)180$48.03
2360$96.06
3540$144.09

À 480p, les mêmes trois niveaux sont $21.35, $42.70 et $64.04.[5]

Le chiffre réaliste est la deuxième ou la troisième ligne. Le travail enchaîné a un mode de défaillance que les clips individuels n'ont pas: un segment peut être individuellement bon et toujours être faux, parce qu'il s'est éloigné du précédent, et tu ne le découvres qu'après l'avoir généré. Budgétise les tentatives ou tu seras surpris deux fois.

Une économie évidente s'ensuit. Conçois la séquence complète à 480p, confirme que la chaîne tient et que les coupes tombent, puis régénère uniquement les segments qui survivent à l'examen à 720p. C'est $21 de conception au lieu de $48, et c'est le plus grand levier sur une pièce longue.

Quand laisser le modèle choisir la longueur

Seedance 2.5 accepte duration: -1, qui cède le choix au modèle, et c'est requis plutôt qu'optionnel pour les invites d'édition vidéo.[1] La facturation se réserve au plafond de 30 secondes et se règle à la longueur réellement produite, remboursant la différence.[5]

Pour l'enchaînage, les durées explicites sont généralement meilleures. Une séquence construite à partir de segments de longueur connue est une que tu peux couper à la musique ou à un scénario; une séquence de longueurs choisies par le modèle est une que tu dois conformer ensuite. Utilise -1 pour les éditions, où le fournisseur l'exige, et pour les clips individuels où la longueur naturelle est vraiment inconnue.

FAQ

Quelle est la génération de vidéo IA individuelle la plus longue disponible?

30 secondes, sur Seedance 2.5.[1] La plupart des autres modèles limitent à 15 et Veo 3.1 est fixe à 8.[2][3][4]

Comment faire en sorte qu'un générateur vidéo IA produise de longs vidéos?

Enchaîne les générations. Définis return_last_frame: true, puis passe le last_frame_url renvoyé à l'appel suivant comme un rôle first_frame.[1] Il n'y a aucun seul appel qui produit des minutes de sortie.

Pourquoi ma requête enchaînée est-elle rejetée pour le rapport d'aspect?

Parce qu'une tâche de première image n'accepte que size: "adaptive", ou aucun champ de taille du tout.[1] Supprime size de chaque segment après le premier.

Puis-je utiliser les images de référence et l'enchaînage d'images ensemble?

Non. image_urls et image_with_roles s'excluent mutuellement, tout comme image_with_roles et video_urls.[1]

Combien coûte une vidéo IA de trois minutes?

Environ $48 à 720p si chaque segment se place lors de la première tentative, et environ $144 à trois tentatives chacun.[5] La conception à 480p en premier réduit la phase d'exploration à environ $21.

Pourquoi l'audio saute-t-il entre les segments?

Chaque génération crée son propre audio. Désactive generate_audio pour le travail enchaîné et place une seule piste sur le montage terminé.

Les jonctions sont-elles transparentes?

Les jonctions le sont. La dérive entre les segments est ce qui trahit une chaîne: changement de couleur, mouvement redémarré, et erreur d'identité sur les visages.

Construire la longueur à partir de segments

Il n'y a aucun mode générateur vidéo IA longs videos, et traiter son absence comme une limitation de l'outil plutôt que de la technologie pousse les gens à acheter des forfaits pour la chercher. Ce qui existe, c'est un plafond de 30 secondes, un mécanisme d'enchaînage d'images, trois règles de paramètres appliquées à la soumission, et quatre types de dérive qui ne le sont pas.

Planifie autour d'eux dans cet ordre. Définis le rapport d'aspect dans le segment un parce que tu ne peux pas le changer plus tard. Écris les finales de segments qui arrivent au repos. Génère en silence et évalue l'assemblage. Conçois à 480p et termine à 720p. Puis fixe le prix de tout le truc à trois tentatives par segment, parce que c'est ce qu'il faudra vraiment.

Fais cela et un flux de travail générateur vidéo IA longs videos cesse d'être une fonctionnalité que tu recherches et devient une construction que tu peux budgétiser. La référence des paramètres et les codes d'erreur sont sur reapi.ai/docs/seedance-2-5, et les tarifs actuels par seconde sont sur la page du modèle Seedance 2.5.

References

  1. reAPI. doubao-seedance-2.5-face — duration, return_last_frame, image_with_roles and cross-field constraints. Retrieved August 2026 from reapi.ai/docs/seedance-2-5
  2. reAPI. Seedance 2.0 — parameter reference and duration limits. Retrieved August 2026 from reapi.ai/docs/seedance-2-0
  3. reAPI. MiniMax H3 — parameter reference and duration limits. Retrieved August 2026 from reapi.ai/docs/minimax-h3
  4. reAPI. Veo 3.1 — parameter reference, fixed 8-second duration. Retrieved August 2026 from reapi.ai/docs/veo3-1
  5. reAPI. Seedance 2.5 — published per-second rate band and auto-duration settlement. Retrieved 9 August 2026 from reapi.ai/models/seedance-2-5
  6. reAPI. Grok Imagine 1.5 — parameter reference and duration limits. Retrieved August 2026 from reapi.ai/docs/grok-imagine-video-1-5

Further reading