Wan 2.7 ist das, was passiert, wenn Alibaba fragt: Was wäre, wenn die KI über dein Video nachdenken würde, bevor sie es macht?
Jede frühere Version der Wan-Serie — und die meisten KI-Videogeneratoren generell — funktioniert gleich: Prompt empfangen, Video generieren, das Beste hoffen. Wan 2.7 bricht dieses Muster. Sein Thinking Mode interpretiert deinen Prompt, plant Szenenstruktur und Erzählbogen, berücksichtigt Komposition und Bewegungsdynamik — und beginnt dann erst mit dem Rendering. Das Ergebnis ist weniger generisch, weniger driftig, intentionstreuer. Der Unterschied zwischen einem Kameramann und einem Regisseur.
Das technische Fundament ist eine 27B Mixture-of-Experts-Architektur mit einem Diffusion Transformer und Full Attention — speziell dafür konzipiert, räumliche und zeitliche Beziehungen gleichzeitig zu verarbeiten.
Die praktischen Upgrades sind ebenso bedeutend: Erstes-und-Letztes-Frame-Kontrolle für präzise Übergänge, bis zu 9 multimodale Referenz-Inputs für Charakter-Konsistenz, natives Audio in einem Durchlauf, instruktionsbasierte Bearbeitung ohne Neu-Generierung.
Die Apache-2.0-Lizenz bleibt Wans definierendes Versprechen. Null Einschränkungen. Die Community, die Wan 2.1 zum ComfyUI-Standard gemacht hat, wechselt bereits zu 2.7. Das Ökosystem folgt — wie immer.