
Opus 5.5 Videogenerierung: Seedance 2.5 Shots instruieren
Opus 5.5 Videogenerierung richtig gemacht: Claude schreibt den Shot-Plan, GPT Image 2.5 fixiert die Figur, Seedance 2.5 rendert. Prompts, Code, Kosten.
Opus 5.5 Videogenerierung erscheint nun in YouTube und Brave Autocomplete, und der Satz verbirgt ein Missverständnis. Claude Opus 5.5 rendert keine Videos. Es ist ein Sprachmodell mit einem 1-Million-Token-Kontextfenster, das über einen Chat-Endpunkt bereitgestellt wird[1]. Was es ungewöhnlich gut macht, ist der Teil, den die meisten KI-Clips falsch machen: Entscheiden, wer im Bild ist, wo die Kamera sitzt, was Sekunde für Sekunde passiert und was der Audio sein sollte.
Das klarste öffentliche Beispiel ist eine Aufschlüsselung vom 24. September auf r/Seedance_AI. Der Autor sagte, er habe "nicht einen einzigen Prompt manuell geschrieben": Opus 5.5 verwandelte ein Konzept und einige Style-Screenshots in Character Sheets, Startframes, Kamerabewegungen, Dialog-Timing und Sound, und die Pixel kamen von GPT Image 2.5 und Seedance 2.5[2]. Diese Anleitung zerlegt diese Pipeline, überprüft jeden Schritt gegen die Dokumentation der Anbieter selbst und zeigt, wie man alle drei Modelle von einem API-Schlüssel aus ausführt.
TL;DR
- Opus 5.5 plant, es rendert nicht. In diesem Workflow schreibt es jeden Prompt; GPT Image 2.5 zeichnet die Stills und Seedance 2.5 macht den beweglichen, sprechenden Shot[2].
- Beschreibe den Kameraoperator, nicht "Realismus". Der Schlüssel der Aufschlüsselung ist es, dem Modell zu sagen, wer die Kamera hält und wo er sitzt, was zu handheld sway, autofocus hunting und Belichtungsverschiebeungen führt[2].
- GPT Image 2.5 ist der Identitätsanker. OpenAI sagt, es ist "besser beim Bewahren der Motive in deinen Referenzfotos"[3], was genau das ist, was ein Character Sheet braucht.
- Seedance 2.5 will Struktur. ByteDances Anleitung verlangt nummerierte Asset-Bindungen (Image 1, Image 2), lückenlose Zeitstempel und explizite negative Kontrollen wie "Keine Untertitel"[4].
- Kosten werden von Video-Sekunden dominiert. Zwei 10-sekündige 1080p Seedance 2.5 Shots kosten $9.24 auf reAPI; die zwei Stills und der Opus 5.5 Planning Run addieren sich zu deutlich unter einem Dollar[5][6][7].
Warum Opus 5.5 Videogenerierung mit einem Skript beginnt
Video-Modelle belohnen Spezifität und bestrafen Mehrdeutigkeit. ByteDance sagt es direkt in seinem Seedance 2.5 Leitfaden: Das Schreiben von Prompts "beeinflusst hauptsächlich die Befolgung von Anweisungen, die Materialiekonsistenz und die Generierungskontrollierbarkeit," und es ändert nicht die zugrunde liegenden Grenzen des Modells[4]. Der gleiche Leitfaden warnt, dass zu wenig Plot in einem Zeitbereich dem Modell erlaubt zu improvisieren, während zu viel übermäßige Schnitte oder fallende Beats erzeugt[4].
Das ist ein Schreibproblem, und hier verdient sich ein starkes Sprachmodell seine Kosten. Ein einzelner Seedance 2.5 Shot in der Reddit-Aufschlüsselung geht über 1.200 Wörter: einen Referenzblock, einen Kameraverschluss, vier zeitgesteuerte Beats mit Dialog und Emotions-Hinweisen, einen Film-Look-Bereich, einen Audio-Bereich und eine Liste von Negationen[2]. Das alles über mehrere Shots hinweg konsistent von Hand zu halten ist mühsam. Opus 5.5 zu fragen, um die Character Bible im Kontext zu halten und jeden Prompt auszugeben, ist nicht.
Anthropics eigenes Pitch für Opus 5.5 handelt genau von dieser Art von Disziplin. Es sagt, das Modell "stellt die wichtigsten Informationen an die Spitze" und "folgt den Schreibregeln, die du ihm gibst"[8]. Für Prompt-Generierung ist es wichtiger, deinen Template jedes Mal zu folgen als Flair zu zeigen.
Ein Kommentator auf der Aufschlüsselung nannte es ein Sprachmodell, das die Arbeit des Video-Modells macht. Ein anderer antwortete auf den praktischen Punkt: "diese Prompts sind massiv, und es kann schwierig sein, alles zu halten und es korrekt in jedem Prompt zu formatieren"[2]. Der gleiche Kommentator notierte die Kosten dieses Ansatzes: Claude neigt dazu, "einen Haufen Müll" hinzuzufügen, wenn du es um Korrektionen fragst, also bearbeite das Template, nicht die Ausgabe.
Die vierstufige Pipeline, Schritt für Schritt
| Stufe | Modell | Eingabe | Ausgabe |
|---|---|---|---|
| 1. Regisseur | Claude Opus 5.5 | Ein Konzept, Style-Screenshots, dein Prompt-Template | Character Bible, Image Prompts, zeitgesteuerte Video Prompts |
| 2. Character Sheet | GPT Image 2.5 | Foto des Motivs + Style-Referenzen + Sheet-Prompt | Eines 16:9 Sheet: Umdrehung, Ausdrücke, Detail-Panels |
| 3. Startframe | GPT Image 2.5 | Character Sheet + Scene Prompt | Der exakte erste Frame des Shots |
| 4. Shot | Seedance 2.5 | Character Sheet + Startframe + zeitgesteuerter Prompt | 10-Sekunden-Clip mit Dialog und Umgebungssound |
Der Character-Sheet-Prompt der Aufschlüsselung ist ein gutes Template zum Kopieren. Er verlangt nach einer sechsteiligen Umdrehungsreihe und einer Reihe von fünf Ausdrücken plus einem Detail-Panel, und erklärt "Identität ist gesperrt, kein Drift zwischen Panels," während die Style-Bilder als "NUR STIL" markiert werden[2]. Diese Aufteilung ist wichtig: eine Style-Referenz, die nicht gekennzeichnet ist, kann ihre Person in deinen Charakter lecken lassen.
Der Startframe ist, wo der Look gebacken wird. Der Autor legte die Benotung von Anfang der 2000er Jahre Punkt-und-Schießen direkt in den Image-Prompt: "35mm Film, 28mm Weitwinkelobjektiv mit leichter Fassverzerrung," "gehobene Schwarztöne," "sichtbarer feiner Filmkörner"[2]. Seedance 2.5 behandelt dann diesen Frame als die Master-Referenz für Position, Licht und Benotung.
Für Stufen 2 und 3 kommt GPT Image 2.5 in zwei Versionen. OpenAI positioniert Flare als "die Standardwahl für die meisten Anwendungen" und Sunburst für "Premium-Visual-Workflows, die von tighterer Kontrolle über Edits profitieren"[3]. Ein Character Sheet, das du für jeden Shot wiederverwendest, ist ein angemessener Ort, um die zusätzlichen $0.002 pro Image für Sunburst auszugeben.
Der Kameraoperator-Trick und was der Seedance-Leitfaden hinzufügt
Das Detail, das Kommentatoren heraushoben, war der zweite Punkt des Autors: Frag nicht nach einem "realistischen Video." Sag wer die Kamera hält, wo sie sitzen und wie sie sich bewegt[2]. Der Autor berichtet, dass eine Zeile, "mein Freund filmt vom Rücksitz," genug für Opus 5.5 war, um Mikro-Zitter, verzögerte Rahmung, autofocus hunting und Belichtungsverschiebeungen in den Prompt zu schreiben.
Das funktioniert, weil Seedance 2.5 Plain-Kamera-Sprache versteht. ByteDance listet Shot-Größen, Bewegungen wie "push in," "orbit," und "handheld shake," Winkel wie "first-person perspective," und Techniken wie Long-Take-Aufnahmen als Begriffe auf, die du direkt schreiben kannst[4]. Ein Kameraoperator mit einer Position und einem Körper gibt dem Modell einen Grund, sie konsistent zu nutzen.
Fünf weitere Regeln aus dem offiziellen Leitfaden gehören in das Template, das du Opus 5.5 gibst:
- Nummere und binde jeden Asset. Beziehe dich auf Uploads als Image 1, Image 2 in Upload-Reihenfolge und erkläre jede Bindung im Text. ByteDance warnt davor, sich auf Etiketten zu verlassen, die ins Bild gezeichnet sind[4].
- Halte Zeitstempel kontinuierlich. Schreibe "0-3 Sekunden... 3-7 Sekunden..." und vermeid Lücken; benutze Zeitstempel nicht für schnelle wiederholte Aktionen wie "schüttel deinen Kopf dreimal pro Sekunde"[4].
- Sag, was du nicht im Audio willst. "Kein BGM; nur Umgebungsgeräusche und Action-Sounds generieren" und "Keine Untertitel" sind beide unterstützte Negative[4].
- Setze gesprochene Zeilen in doppelte Anführungszeichen. reAPIs Seedance 2.5 Referenznoten sagen, dass Anführungszeichen die generierten Sprache steuern[9].
- Budget das Plot pro Zeitbereich. Jede Stufe sollte ein klares Ereignis halten und einen Endzustand[4].
ByteDance veröffentlicht auch eine offizielle Seedance 2.5 Prompt-Optimierungs-Skill. Sein Leitfaden empfiehlt, sie mit npx --yes skills@latest add "https://arkdocs-en.tos-ap-southeast-1.volces.com/skills/" --skill sd25-pe --yes zu installieren, dann /sd25-pe gefolgt von deinem Prompt in einer KI-Chat-Box einzutippen[4]. Opus 5.5 kann den Shot entwurf, und die Skill kann ihn dann gegen ByteDances Übereinkunft überprüfen.
Ein Regisseur-Prompt für Opus 5.5
Jeder Opus 5.5 Videogenerierungs-Lauf beginnt vom gleichen Anweisungsblock. Dies ist ein Anfangs-Template, nicht ein Abschrift der Reddit-Autors-Sitzung. Ersetze die eingeklammerten Teile.
You are the director and prompt writer for a short live-action AI video.
Concept: [one paragraph]
Style references: Image 2 and Image 3 are STYLE ONLY (grade, lens, grain).
Subject: Image 1 is the person. Identity must never drift.
Camera operator: [who films, where they sit, what device, how they move].
Produce, in order:
1. A character bible: face, hair, wardrobe, jewelry, props. Fixed wording.
2. A GPT Image 2.5 prompt for a 16:9 character sheet (turnaround,
five expressions, detail panels, "Identity is locked").
3. A GPT Image 2.5 prompt for the start frame of shot 1.
4. A Seedance 2.5 prompt per shot, 10 seconds each, with:
- Asset bindings: "Image 1 = identity, Image 2 = start frame"
- A camera section written from the operator's point of view
- Continuous timestamps (0-3s, 3-5s, 5-8.5s, 8.5-10s), one event each
- Dialogue in double quotes, with emotion cues per phrase
- Audio: on-camera mic only, list ambient sounds, "No BGM" if needed
- Negatives: "No subtitles", no cuts unless requested, no morphing
Reuse the character bible wording verbatim in every prompt.Die letzte Zeile ist diejenige, die Drift stoppt. Wenn jeder Prompt die Halskette leicht anders beschreibt, wird das Video-Modell es auch.
Opus 5.5, GPT Image 2.5 und Seedance 2.5 von einem Schlüssel aus laufen
Alle drei Modelle sitzen hinter dem gleichen reAPI-Schlüssel. Opus 5.5 nutzt den Chat-Completions-Endpunkt mit Modell-ID claude-opus-5-5[1]. GPT Image 2.5 und Seedance 2.5 sind asynchron: du schickst, erhältst eine Task-ID und fragst ab GET /api/v1/tasks/{id} bis der Status completed ist[9][10].
import time, requests
BASE = "https://reapi.ai/api/v1"
H = {"Authorization": "Bearer YOUR_API_KEY"}
def wait(task_id):
while True:
t = requests.get(f"{BASE}/tasks/{task_id}", headers=H).json()
if t["status"] in ("completed", "failed"):
return t
time.sleep(10)
# 1. Opus 5.5 writes the prompts (DIRECTOR_PROMPT = the template above)
plan = requests.post(f"{BASE}/chat/completions", headers=H, json={
"model": "claude-opus-5-5",
"messages": [{"role": "user", "content": DIRECTOR_PROMPT}],
"reasoning_effort": "high",
"max_tokens": 16000,
}).json()["choices"][0]["message"]["content"]
# parse SHEET_PROMPT, FRAME_PROMPT, SHOT_PROMPT out of `plan`
# 2. Character sheet from the subject photo and style references
sheet = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
"model": "gpt-image-2.5-sunburst",
"prompt": SHEET_PROMPT,
"image_urls": [SUBJECT_URL, STYLE_URL_1, STYLE_URL_2],
}).json()["id"])["output"]["image_urls"][0]
# 3. Start frame, anchored to the sheet
frame = wait(requests.post(f"{BASE}/images/generations", headers=H, json={
"model": "gpt-image-2.5-sunburst",
"prompt": FRAME_PROMPT,
"image_urls": [sheet],
}).json()["id"])["output"]["image_urls"][0]
# 4. The 10-second shot. Image 1 = sheet, Image 2 = start frame
shot = wait(requests.post(f"{BASE}/videos/generations", headers=H, json={
"model": "doubao-seedance-2.5-face",
"prompt": SHOT_PROMPT,
"image_urls": [sheet, frame],
"duration": 10,
"resolution": "1080p",
"size": "16:9",
}).json()["id"])["output"]["video_urls"][0]
print(shot)Drei Details aus der Referenz-Dokumentation sind es wert zu wissen, bevor du es laufen lässt. Jedes Media-Feld muss eine öffentliche HTTP(S) URL sein; Base64 und data: URIs werden abgelehnt[9]. Seedance 2.5 akzeptiert bis zu 30 Referenzbilder, so dass ein Sheet, ein Startframe und ein paar Prop Shots leicht passen[9]. Und Opus 5.5 denkt immer anpassungsfähig; reasoning_effort ändert wie tief, und die native Standardeinstellung ist mittel[1].
Was ein Opus 5.5 Videogenerierungs-Lauf kostet
Preise unten sind reAPIs veröffentlichte Raten am 29. September 2026[5][6][7]. Die Opus 5.5 Zeile nimmt an, dass eine Planning-Sitzung 30.000 Input-Tokens und 10.000 Output-Tokens verbraucht. Diese Figur ist eine Illustration, keine Messung; deine Template-Länge und Anstrengungsstufe bewegen sie.
| Artikel | Rate | Menge | Kosten |
|---|---|---|---|
| Opus 5.5 Input | $3.20 pro 1M Tokens | 30.000 | $0.096 |
| Opus 5.5 Output | $16.00 pro 1M Tokens | 10.000 | $0.160 |
| GPT Image 2.5 Sunburst | $0.025 pro Image | 2 | $0.05 |
| Seedance 2.5, 1080p | $0.462 pro Sekunde | 20 s | $9.24 |
| Gesamt | etwa $9.55 |
Video-Sekunden sind über 96% der Rechnung. Die Hebel, die zählen, sind alles auf der Seedance-Seite: 720p läuft $0.267 pro Sekunde ($5.34 für die gleichen 20 Sekunden), und der Seedance 2.5 Eco Tier berechnet 1080p bei $0.347 pro Sekunde ($6.94) mit dem gleichen Request Body[7][9]. Eine vernünftige Routine ist, bei 720p zu iterieren bis die Leistung und Kamera richtig sind, dann den Keeper bei 1080p zu rendern.
Zum Vergleich listet Anthropic Opus 5.5 bei $4 Input und $20 Output pro Million Tokens, und sagt, es kostet etwa 40% weniger als Opus 5 auf typischen Workloads[8]. Auf jeden Fall ist der Regisseur der billige Teil.
FAQ
Kann Claude Opus 5.5 Videos von selbst generieren?
Nein. Opus 5.5 ist ein Sprachmodell, das über Chat-Completions aufgerufen wird; es gibt Text zurück[1]. In einem Opus 5.5 Videogenerierungs-Workflow schreibt es die Prompts, und ein Video-Modell wie Seedance 2.5 rendert den Clip.
Was ist die Seedance 2.5 Skill?
Es ist ByteDances offizielle Prompt-Optimierungs-Skill für Seedance 2.5, genannt sd25-pe. Der BytePlus-Leitfaden installiert es mit npx skills und ruft es auf, indem du /sd25-pe plus deinen Prompt in einer KI-Chat-Box eingibst[4].
Wie lang kann ein Seedance 2.5 Video sein?
Bis zu 30 Sekunden pro Generierung. Auf reAPI akzeptiert duration 4 bis 30 Sekunden, oder -1 um das Modell wählen zu lassen[9]. Der Reddit Workflow nutzte 10-Sekunden-Shots und schnitt sie zusammen[2].
Wie viel kostet ein Opus 5.5 und Seedance 2.5 Clip?
Etwa $9.55 für zwei 10-Sekunden 1080p Shots, zwei GPT Image 2.5 Sunburst Stills und eine Planning-Sitzung bei den angenommenen Token-Mengen oben. Rendern bei 720p bringt den gleichen Lauf auf etwa $5.65[5][6][7].
Sollte ich GPT Image 2.5 Flare oder Sunburst für das Character Sheet benutzen?
Sunburst, wenn das Sheet mehrere Shots verankern wird. OpenAI beschreibt es als "tightere Kontrolle über Edits" bietend; Flare ist die schnellere Standardeinstellung[3]. Auf reAPI ist der Unterschied $0.023 versus $0.025 pro Image[6].
Brauche ich Claude Code für diesen Workflow?
Nein. Das Skript oben ruft Opus 5.5 über Plain HTTP auf. Anthropic bietet Opus 5.5 in Claude Code an, einschließlich eines schnellen Modus[8], und das ist ein komfortabler Ort, um auf einem Template zu iterieren oder die sd25-pe Skill zu laufen. Die Production Pipeline braucht nur einen API-Schlüssel.
Kann Opus 5.5 ein Musikvideo planen?
Es kann die Shot-Liste, Timing und Sound-Richtung schreiben. Seedance 2.5 generiert Sprache, Sound-Effekte und Hintergrundmusik mit dem Clip, und es akzeptiert auch Referenz-Audio (bis zu 10 Tracks, 30 Sekunden zusammen), so dass ein Lied die Bearbeitung fahren kann[9].
Behandle Opus 5.5 als Regisseur und Seedance 2.5 als die Crew
Der Workflow, der r/Seedance_AI herumging, erfolgreich ist aus einem langweiligen Grund: jeder Prompt ist lang, spezifisch und konsistent, und ein Sprachmodell ist besser als ein müder Mensch beim Produzieren davon. Gib Opus 5.5 ein festes Template, eine Character Bible, die es Wort für Wort wiederverwenden muss, und einen Kameraoperator mit einem Sitz und einem Gerät. Lass GPT Image 2.5 das Gesicht sperren, und verbringe dein Iterationsbudget auf Seedance 2.5 Sekunden bei 720p, bevor das letzte 1080p-Render. Das ist Opus 5.5 Videogenerierung, die wirklich versendet: ein Modell zum Denken, zwei zum Rendern, und ein API-Schlüssel für alle drei auf reAPI.
References
- reAPI. Claude Opus 5.5 API: model ID, parameters and pricing. Retrieved September 2026 from reapi.ai/docs/claude-opus-5-5
- r/Seedance_AI. Full Breakdown: How I used Claude Opus & Seedance 2.5 to achieve photorealistic AI videos (All Prompts Included). Posted September 24, 2026. Retrieved September 2026 from reddit.com/r/Seedance_AI/comments/1wop0ju
- OpenAI. Introducing ChatGPT Images 2.5. September 8, 2026. Retrieved September 2026 from openai.com/index/introducing-chatgpt-images-2-5
- BytePlus ModelArk. Dreamina Seedance 2.5 prompt guide. Retrieved September 2026 from docs.byteplus.com/en/docs/modelark/seedance-2-5-prompt-guide
- reAPI. Claude Opus 5.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/claude-opus-5-5
- reAPI. GPT Image 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/gpt-image-2-5
- reAPI. Seedance 2.5 model page and pricing. Retrieved September 29, 2026 from reapi.ai/models/seedance-2-5
- Anthropic. Introducing Claude Opus 5.5. Retrieved September 2026 from anthropic.com/claude-opus-5-5
- reAPI. Seedance 2.5 API: parameters, modes and billing. Retrieved September 2026 from reapi.ai/docs/seedance-2-5
- reAPI. GPT Image 2.5 API reference. Retrieved September 2026 from reapi.ai/docs/gpt-image-2-5
Autor

Kategorien
Weitere Beiträge

Gemini Omni vs. Veo 3.1: Lohnt der Wechsel im Mai 2026?
Gemini Omni vs. Veo 3.1 im Mai 2026: Google ersetzt Veo nur in der Gemini-App, nicht in der API. Fünf-Kanal-Mapping, Code-Diff und wo jedes Modell gewinnt.


KI-Bildgenerierung für Spiele: Kosten durch Caching senken
Cache-First-Pipeline für Spielbilder mit semantischen Keys, Single-Flight-Anfragen, asynchronem Polling, Budget-Caps und praktischer Kostenrechnung.


Venice.ai-Alternativen 2026: 5 Optionen im Vergleich
Auf der Suche nach Venice.ai-Alternativen 2026? Vergleiche OpenRouter, Together AI, DeepInfra, lokales Ollama und reAPI bei Modellen, Datenschutz und Preisen.
