Seedance 2.5 is live — 30-second cinematic video with native audio & real-person referencesfrom $0.071 pro Sekunde

Wan 3.0 — omnimodaler KI-Videogenerator für 30 Sekunden

Wan 3.0 ist Alibabas Videomodell der nächsten Generation und befindet sich in der öffentlichen Beta. Der KI-Videogenerator erzeugt Clips von bis zu 30 Sekunden in einem Durchgang, nimmt Text, Bilder, Audio, Video und sogar Dokumente entgegen und hält Figuren, Stimmen und Stil per feingranularer Referenzsteuerung stabil. Wan 3.0 kommt in Kürze zu reAPI.

Bald verfügbar — die API für dieses Modell ist noch nicht verfügbar.

Was du mit diesem Modell bauen kannst

Echte Workflows und produktionsreife Use Cases, die du mit diesem Modell bauen und ausliefern kannst.

Ein 30-Sekunden-Video mit KI erstellen — in einem Durchgang

Die meisten Videomodelle enden bei rund 10 Sekunden; Wan 3.0 soll laut Ankündigung bis zu 30 Sekunden in einem Durchgang erzeugen — genug für eine vollständige Szene mit Anfang, Mitte und Ende. Statt Clips zusammenzuschneiden und gegen Anschlussfehler zu kämpfen, beschreibst du den ganzen Bogen einmal, und Wan 3.0 rendert ihn als eine einzige Einstellung. Sobald die API öffnet, gibt es dieselbe Videogenerierung in einem Durchgang hier auf reAPI.

Doku-Vorschau ansehen

Gib Wan 3.0 alles — sogar Dokumente

Wan 3.0 nimmt die vier Basismodalitäten entgegen — Text, Bilder, Audio und Video — und erstmals in der Wan-Familie auch Dokumente: doc-, xls-, ppt-, pdf- und md-Dateien können eine Generierung antreiben. Aus einem Foliensatz wird ein Produkterklärer, aus einem Bericht ein vertonter Zusammenfassungsclip. So kannst du aus dem Material, das du ohnehin hast, ein Video mit KI erstellen — ganz ohne Storyboard-Schritt.

Figuren, Stimmen und Stil bleiben fixiert

Wan 3.0 erweitert die Referenzgenerierung um feingranulare Steuerung: Figuren, Requisiten, Stimmen, räumliche Beziehungen und Stil sollen laut Ankündigung über alle Einstellungen hinweg stabil bleiben. Und die Bearbeitung geht weiter als ein bloßes Neu-Rendern — Wan 3.0 soll Bild, Handlung und Dialog eines Clips verändern können. Wiederkehrende Figuren und dein Markenlook überleben so von einer Generierung zur nächsten.

Warum reAPI

Ein Generationssprung in einem Durchgang

Wan 3.0 führt die Wan-Familie von kurzen Clips zu 30-Sekunden-Szenen in einem Durchgang — mit Audio, Figurenkonsistenz und auf ganzer Linie angekündigten Verbesserungen bei der Darstellung realer Szenen. Wenn deine Pipeline heute 5-Sekunden-Segmente zusammensetzt, schrumpft Wan 3.0 diesen Ablauf auf eine einzige Anfrage.

Omnimodal rein, Video raus

Text, Bilder, Audio, Video und Dokumente treiben alle dasselbe Modell an. Wan 3.0 leitet anhand dessen, was du übergibst — keine getrennten Produkte für Text-zu-Video, Bild-zu-Video, Referenz-zu-Video oder Bearbeitung —, sodass eine einzige Integration jeden Modus der Videogenerierung abdeckt, sobald Wan 3.0 auf reAPI landet.

Nutzungsbasiert zum Start

Wenn Wan 3.0 hier öffnet, folgt die Abrechnung dem Plattformstandard: pro abgeschlossener Generierung, skaliert nach Auflösung und Dauer, mit automatischer Erstattung fehlgeschlagener Aufträge. Kein Abo — Credits sind nutzungsbasiert und verfallen nicht.

Wan 3.0 vs. Wan 2.7

Wan 3.0 folgt auf die ausgelieferte Generation Wan 2.7. Die Zeilen unten vergleichen, was Alibaba zur öffentlichen Beta von Wan 3.0 angekündigt hat, mit dem, was Wan 2.7 heute auf reAPI dokumentiert — angekündigtes Verhalten auf der einen, ausgeliefertes auf der anderen Seite.

Funktion
Wan 3.0 (angekündigt)
Wan 2.7 auf reAPI
Status
Öffentliche Beta seit dem 6. August 2026; die Anbieter-API öffnet in Kürze vollständig. Bald auf reAPI.
Heute live auf reAPI — Playground, Doku und Preis pro Sekunde.
Maximale Dauer
Bis zu 30 Sekunden in einem Durchgang.
2 bis 15 Sekunden bei Basismodi; Referenz- und Bearbeitungsmodi sind kürzer begrenzt.
Auflösungen
480P, 720P und 1080P.
720P und 1080P.
Eingabemodalitäten
Text, Bild, Audio, Video plus Dokumente: doc, xls, ppt, pdf, md.
Text, Bild, Audio und Video.
Referenzsteuerung
Feingranular: Figuren, Requisiten, Stimmen, räumliche Beziehungen und Stil sollen stabil bleiben.
Referenzbilder, -videos und Stimmen pro Motiv halten Motive konsistent.
Bearbeitung
Soll laut Ankündigung Bild, Handlung und Dialog verändern.
Rendert ein Quellvideo anhand eines Prompts neu; audio_setting steuert die Tonspur.

Die Zeilen zu Wan 3.0 geben Alibabas Ankündigung zur öffentlichen Beta vom 6. August 2026 wieder und sind vorläufig, bis die API allgemein verfügbar ist. Die Zeilen zu Wan 2.7 spiegeln das zum Zeitpunkt der Erstellung auf reAPI dokumentierte Verhalten wider.

In drei Schritten bereit für Wan 3.0

  1. step 01

    API-Schlüssel erstellen

    Registriere dich und erstelle jetzt einen Schlüssel im Dashboard — keine Kreditkarte nötig. Derselbe Schlüssel funktioniert für jedes reAPI-Modell, zum Start auch für Wan 3.0.

    Öffnen
  2. step 02

    Die Anfrageform vorab ansehen

    Die Doku-Vorschau zeigt die vorläufige Anfrage für Wan 3.0: ein Prompt oder eine Medieneingabe, eine Auflösungsstufe und eine Dauer von bis zu 30 Sekunden. Die Felder werden final, sobald die Anbieter-API öffnet.

    Öffnen
  3. step 03

    Zum Start live gehen

    Sobald Wan 3.0 erscheint, stehen Modell-ID, Parameter und Sekundenpreise auf dieser Seite fest und das Playground geht live. Integrationen, die gegen die Vorschau gebaut wurden, brauchen höchstens eine Nachbesserung auf Feldebene.

    Öffnen

Häufig gestellte Fragen

Häufige Fragen zu diesem Modell.

Wan 3.0 ist Alibabas Videomodell der nächsten Generation (Tongyi Wanxiang 3.0) und damit ein KI-Videogenerator für die komplette Videogenerierung. Es ist am 6. August 2026 in die öffentliche Beta gestartet und soll laut Ankündigung bis zu 30 Sekunden Video in einem Durchgang aus Text, Bildern, Audio, Video und Dokumenten erzeugen — mit feingranularer Referenzsteuerung über Figuren, Requisiten, Stimmen, räumliche Beziehungen und Stil.

start building

Bereit zum Start?

Probiere es im Playground aus oder hol dir einen API-Key, um direkt loszulegen.