Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Seedance 2.5 Kamerasteuerung: Zahlen, nicht Adjektive
2026/07/27

Seedance 2.5 Kamerasteuerung: Zahlen, nicht Adjektive

Seedance 2.5: Steuere die Kamera mit expliziten Geschwindigkeiten, Rigs und Zeitmarken – nicht mit Adjektiven, die zu schnellen Bewegungen führen.

Generiere einen 30-Sekunden-Shot mit „smooth cinematic pan" im Prompt und die virtuelle Linse schnellt wie eine entlaufene Drohne durchs Zimmer. Das Motiv bleibt verschwommen zurück. Das ist die häufigste Frustration mit Seedance 2.5 Kamera-Kontrolle, und es ist kein Bug.

Adjektive sind keine Geschwindigkeiten. Das Modell ordnet beschreibende Wörter zu Standard-Bewegungsvektoren, und Wörter wie smooth, epic und dramatic führen zu schnellen Bewegungen. Die Lösung: Schreibe deinen Prompt wie Regieanweisungen, nicht wie Stimmungsbeschreibungen.

Kurzfassung

  • Ersetze Adjektive durch Zahlen. „Langsame Lateral-Dolly mit 2 Sekunden pro Meter" schlägt „schnelle Panorama durchs Zimmer".
  • Benenne das Rig. Dolly, Crane, stationärer Stativständer, Tracking-Shot. Mechanische Begriffe zwingen das Bewegungsmodell zu physikalisch plausiblen Pfaden, was Stimmungswörter nicht tun.
  • Teile den Shot in zeitgestempelte Beats ein, damit das Modell weiß, wann eine Bewegung beginnt, hält und stoppt.
  • Verankere den Raum mit Referenzmaterial, statt ihn zu beschreiben – das verhindert Koordinatenverlagerung über längere Takes.
  • Längere Generierungen driften mehr ab. Das 30-Sekunden-Fenster macht explizite Beschränkungen notwendiger, nicht weniger.

Warum die Standard-Geschwindigkeit zu schnell ist

Das Modell arbeitet in einem komprimierten latenten Raum, und Text-Hinweise werden zu Geschwindigkeitsvektoren abgebildet, bevor etwas dargestellt wird. Generische Beschreibungen haben kein physikalisches Gewicht, sodass die Zuordnung zu breiten, hochbeschleunigten Trajektorien führt.

Daraus entstehen drei Ausfallmodi, die sich über längere Takes verstärken.

Semantische Lücke. „Smooth" und „dramatic" sind keine Geschwindigkeitsmetriken. Neurale Gewichtungen lesen sie als Erlaubnis für maximale Beschleunigung, nicht als Anweisungen für absichtliche Bewegungen.

Latente Abweichung. Ohne harte Beschränkungen wandern räumliche Koordinaten über eine erweiterte Zeitachse ab. Eine Wand, die bei Sekunde drei links war, ist bei Sekunde zwanzig woanders.

Pacing-Zusammenbruch. Schnelle Standard-Zuordnungen zerstören die Orientierung des Zuschauers in den ersten Sekunden – genau der Teil, der entscheidet, ob jemand weiterschaut.

Ersetze Adjektive durch Zahlen

Das ist die ganze Technik, und die Tabelle unten ist die funktionierende Version davon.

AusfallmodusVermeideNutze stattdessen
Überraschend schnelle Panorama„Smooth, epic Kamera-Panorama durchs Zimmer"„Lateral-Tracking-Shot mit 0,5 m/s, feste Brennweite, 4-sekündige lineare Progression"
Unkontrollierter Zoom„Dramatischer Zoom ins Motiv"„Gradueller Fokus-Push von Weitwinkel (24 mm) zu Medium (50 mm) über 10 Sekunden"
Koordinatenverlagerung„Schneller Drohnen-Shot über die Landschaft"„Niedriger stabiler Luftgleitflug, Höhe auf 3 Meter gesperrt, Richtungsvektor 090"

Aus diesen Zeilen lassen sich drei Regeln verallgemeinern.

Definiere numerische Geschwindigkeit. Ersetze jedes beschreibende Wort durch metrische oder zeitbasierte Pacing. Meter pro Sekunde oder Sekunden pro Meter funktionieren beide. Wichtig ist, dass eine Zahl vorkommt.

Sperr das mechanische Rig. Nenne Dolly, Crane, stationären Stativständer oder Tracking-Shot explizit. Die Benennung echter Ausrüstung zwingt das Bewegungsmodell zu physikalisch plausiblen Pfaden, weil diese Wörter räumliche Beschränkungen mit sich bringen, die „cinematic" nicht hat.

Ergänze Zeit-Trigger. Teile einen langen Shot in Phasen ein, damit das Modell weiß, wann es sich bewegen und wann es halten soll.

Zeitgestempelte Beats

Ein 30-Sekunden-Seedance-Take, aufgeteilt in vier zeitgestempelte Beats mit expliziter Geschwindigkeit, im Kontrast zum Wechsel von Adjektiv zu Zahl im Prompt

Das 30-Sekunden-Fenster ist der Punkt, wo Prompt-Struktur nicht mehr optional ist. Ein einzelner Absatz, der einen ganzen Shot beschreibt, gibt dem Modell keinen Grund, irgendwann stillzuhalten, also bewegt es sich ständig.

Strukturiere es stattdessen als Beats:

0-6s: [Locked tripod] Medium shot, subject centered, no camera movement.
      Ambient motion only — steam rising, fabric shifting.
6-14s: [Slow dolly in] Push from medium to close at 0.3 m/s, constant speed,
      no easing. Focal length fixed at 50mm.
14-22s: [Hold] Camera static at close range. Subject turns toward the lens.
22-30s: [Lateral track left] 0.4 m/s, subject remains centered in frame,
      background parallax reveals the window.

Diese Struktur bringt dir zwei Dinge. Jeder Beat hat eine explizite Geschwindigkeit, kein Segment erbt eine Standard. Und die Halte-Phasen werden erklärt, nicht nur impliziert – das verhindert, dass das Modell Stille mit Bewegung füllt.

Verankere den Raum, statt ihn zu beschreiben

Referenzmaterial ist die stärkste verfügbare Kontrollfläche, wird aber unternutzt, weil es sich wie zusätzliche Arbeit anfühlt.

Eine Raumbeschreibung in Text gibt dem Modell eine Wahrscheinlichkeitsverteilung über Räume. Ein Referenzangebot gibt ihm Geometrie. Speziell für Kameraarbeit entscheidet dieser Unterschied, ob die Wand bei einer 20-sekündigen Bewegung an Ort und Stelle bleibt.

Die praktische Hierarchie, von stärkster zu schwächster: ein Referenz-Video, dessen Kamerabewegung du echoen möchtest, dann Einzelbilder, die den Raum aus den Winkeln etablieren, die der Shot durchfährt, dann Text für das, das beides nicht abdeckt. Text ist das Fallback, nicht die Grundlage.

Das interagiert auch mit der Abrechnung der 2.0-Generation, wo das Hochladen eines Videos die Anfrage auf einen billigeren Satz verschiebt. Wert zu wissen, wenn eine Pipeline sowieso videozentriert ist.

Fehlerbehebung

Bewegungsunschärfe bei jeder Bewegung. Die Geschwindigkeit ist zu hoch für die Bildrate, um aufgelöst zu werden. Reduziere die numerische Geschwindigkeit, anstatt „less blur" zum Prompt hinzuzufügen, das das Modell als Stilnotiz und nicht als physikalische Beschränkung liest.

Die Kamera driftet vom Motiv ab über einen langen Take. Ergänze eine Rahmenbeschränkung zu jedem Beat: „Motiv bleibt zentriert", „Motiv ist im linken Drittel". Rahmung ist eine Pro-Beat-Eigenschaft, und es nur oben einmal zu sagen, überlebt nicht bis Sekunde 25.

Bewegung beginnt zu früh. Ein Beat ohne explizites Halten wird als Einladung zum Bewegen interpretiert. Erkläre die statischen Segmente.

Jede Generierung sieht anders aus trotz identischer Prompts. Der Raum wird bei jedem Durchlauf neu erfunden. Das ist ein Referenzmaterial-Problem, kein Prompt-Problem.

API-Aufruf

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "0-6s: [Locked tripod] medium shot, no camera movement. 6-14s: [Slow dolly in] push to close at 0.3 m/s, focal length fixed 50mm. 14-22s: [Hold] static, subject turns to lens. 22-30s: [Lateral track left] 0.4 m/s, subject centered.",
    "resolution": "1080p",
    "duration": 30
  }'

Das Hinzufügen von Referenzmaterial verankert die Geometrie:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "seedance-2-5",
    "prompt": "Match the camera move in the reference. Subject remains centered throughout.",
    "video_urls": ["https://example.com/camera-reference.mp4"],
    "image_urls": ["https://example.com/set-wide.jpg", "https://example.com/set-close.jpg"],
    "resolution": "1080p",
    "duration": 30
  }'

Medieneingaben sind nur öffentliche HTTP(S)-URLs, keine Base64 akzeptiert. Aktuelle Sätze und die vollständige Request-Oberfläche findest du auf reapi.ai/models/seedance-2-5.

Häufig gestellte Fragen

Warum bewegt Seedance die Kamera standardmäßig so schnell?

Weil beschreibende Wörter zu Standard-Geschwindigkeitsvektoren abgebildet werden, und generische Beschreibungen führen zu hoher Beschleunigung. Adjektive sind keine Geschwindigkeitsmetriken.

Wie gebe ich die Kamera-Geschwindigkeit präzise an?

Nutze eine Zahl und eine Einheit. „0,5 m/s" oder „2 Sekunden pro Meter" beschränken beide das Modell; „slow" tut das nicht.

Was ist das Zeitstempel-Prompt-Format?

Teile den Shot in Zeitbereiche ein, jeder mit einem geklammerten Rig-Typ, einer expliziten Geschwindigkeit und einer Rahmenbeschränkung. Erkläre auch die Halte-Phasen, nicht nur die Bewegungen.

Wie verhindere ich, dass die Kamera vom Motiv abdriftet?

Ergänze eine Rahmenbeschränkung in jedem Beat, nicht nur am Anfang. Rahmung bleibt nicht von selbst über einen langen Take erhalten.

Hilft Referenzmaterial bei der Kamera-Kontrolle?

Ja, mehr als die Prompt-Formulierung. Ein Referenzvideo, dessen Bewegung du echoen möchtest, ist die stärkste Verankerung, gefolgt von Einzelbildern, die den Raum etablieren.

Warum geben identische Prompts unterschiedliche Kamerawege?

Weil der Raum bei jedem Durchlauf neu hergeleitet wird. Gib Referenzgeometrie an, statt den Raum in Text zu beschreiben.

Was verursacht Bewegungsunschärfe in generierten Shots?

Geschwindigkeit zu hoch für die Bildrate, um aufgelöst zu werden. Senke die numerische Geschwindigkeit, statt nach weniger Unschärfe zu fragen.

Regissieren statt beschreiben

Die mentale Verschiebung, die Seedance 2.5 Kamera-Kontrolle behebt, ist klein und spezifisch. Höre auf zu schreiben, wie sich der Shot anfühlen soll, und schreibe stattdessen, was das Rig tut: welche Ausrüstung, wie schnell beweglich, wie lange, wann haltend, wie gerahmt.

Jedes Adjektiv in einem Kamera-Prompt ist eine Entscheidung, die du dem Modell übergibst und das wird sie zu Bewegung auflösen. Jede Zahl ist eine Entscheidung, die du behältst. Längere Generierungen machen diesen Handel schärfer, weil 30 Sekunden unkontrollierter Interpretation weiter abdriften als fünf. Schreib die Beats, nenne das Rig, gib ihm Geometrie zum Festhalten, und die Ausgabe hört auf, eine Lotterie zu sein.

Quellenangaben

  1. Volcano Engine. Seedance and the Doubao video model family. Retrieved July 2026 from volcengine.com

Weitere Lektüre