Место #1 Локальная видеогенерация — Ваш GPU, ваше кресло режиссера
Alibaba Cloud (Tongyi Lab)

Wan 2.7

Открытая видеомодель, которая научилась думать перед съёмкой. Wan 2.7 — самый большой скачок Alibaba на сегодняшний день: модель Mixture-of-Experts на 27 млрд параметров, которая планирует сцену, синхронизирует звук нативно и даёт контроль над первым и последним кадром. Всё под Apache 2.0. Никаких сносок.

Обновлено Апрель 2026 г. Open WeightApache 2.0Text-to-Video
Лучше всего для

Открытая видеомодель, которая научилась думать перед съёмкой. Wan 2.7 — самый большой скачок Alibaba на сегодняшний день: модель Mixture-of-Experts на 27 млрд параметров, которая планирует сцену, синхронизирует звук нативно и даёт контроль над первым и последним кадром. Всё под Apache 2.0. Никаких сносок.

Почему он побеждает

Режим Thinking планирует структуру сцены до генерации, резко снижая дрейф движения. Нативная синхронизация звука за один проход. Контроль первого и последнего кадра для точных переходов. До 9 мультимодальных референсных входов для согласованности персонажей. Редактирование видео по инструкциям. Архитектура 27B MoE. Apache 2.0.

Обратите внимание

Режим Thinking, делающий его особенным, делает его и медленнее. Нет официального облачного API с мгновенной регистрацией. Масштаб в 27 млрд параметров требует серьёзного железа для локального развёртывания. Документация по-прежнему преимущественно на китайском.

01

Что это на самом деле

Wan 2.7 — это то, что происходит, когда Alibaba задаётся вопросом: а что, если ИИ подумает о вашем видео прежде, чем его создать?

Каждая предыдущая версия серии Wan — и большинство ИИ-генераторов видео в целом — работает одинаково: получить промпт, сгенерировать видео, надеяться на лучшее. Wan 2.7 ломает этот паттерн. Его режим Thinking интерпретирует промпт, планирует структуру сцены и нарративную дугу, рассматривает композицию и динамику движения — и тогда начинает рендеринг. Результат менее шаблонный, менее подверженный дрейфу, более намеренный. Разница между оператором камеры и режиссёром.

Техническая основа — архитектура Mixture-of-Experts на 27 млрд параметров с Diffusion Transformer и Full Attention, специально спроектированная для одновременной обработки пространственных и временных взаимосвязей.

Практические улучшения не менее значительны: контроль первого и последнего кадра для точных переходов, до 9 мультимодальных референсных входов для согласованности персонажей, нативный звук за один проход, редактирование по инструкциям без перегенерации с нуля.

Лицензия Apache 2.0 остаётся определяющим обязательством серии Wan. Ноль ограничений. Сообщество, сделавшее Wan 2.1 стандартом ComfyUI, уже переходит на 2.7. Экосистема последует — как всегда.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Режим Thinking — планирует до генерации: Определяющая инновация Wan 2.7. Прежде чем отрендерить единственный кадр, модель интерпретирует промпт, планирует состав сцены и структурирует нарративную дугу. Результат: значительно меньше шаблонных композиций, меньше дрейфа движения, выше точность воплощения замысла.
  • Контроль первого и последнего кадра: Задайте точные начальный и конечный кадры видео. Точный контроль переходов, позиций персонажей и непрерывности сцен.
  • Нативная синхронизация звука: Звук генерируется вместе с видео за один проход — не добавляется после. Тайминг диалогов, окружающие звуки и музыка возникают как единая композиция с видеорядом.
  • Согласованность референсов — до 9 входов: До 9 мультимодальных референсных изображений или клипов для закрепления идентичности персонажей, стиля и реквизита между сценами.
  • Редактирование видео по инструкциям: Опишите нужное изменение на естественном языке; Wan 2.7 модифицирует существующее видео. Редактирование без перегенерации с нуля.
  • Apache 2.0 — действительно без ограничений: Коммерческое использование, изменение весов, создание продуктов, продажа результатов — всё разрешено без потолка доходов и без атрибуции сверх файла лицензии.

Честные ограничения

  • Режим Thinking увеличивает время генерации: Фаза планирования, улучшающая результаты, также замедляет их. Если приоритет — скорость, LTX Video остаётся более быстрым выбором.
  • Нет официального облачного API с мгновенным доступом: Локальный запуск или точки доступа сообщества (fal.ai, WaveSpeedAI). Реальный барьер для нетехнических пользователей.
  • 27 млрд параметров требуют серьёзного железа: Локальное развёртывание в полном качестве требует памяти GPU значительно выше потребительских карт.
  • Документация преимущественно на китайском: Официальная документация и многие ресурсы сообщества на китайском. Английские руководства отстают от обновлений.
  • Сообщество меньше, чем у Wan 2.1: Экосистема ComfyUI для Wan 2.1 огромна. Рабочие процессы для Wan 2.7 растут, но пока не на том же уровне.
03

Результаты тестов

Архитектура — 27B MoE (40 млрд активных параметров)

Дизайн Mixture-of-Experts с ~753 млрд общих параметров, ~40 млрд активных на токен. DiT с Full Attention для пространственной и временной обработки.

Разрешение — до 4K

До 1080p и 4K на выходе в зависимости от платформы и уровня вычислений. Длительность клипов от 5 до 15 секунд.

Вместимость референсов — до 9 мультимодальных входов

Комбинации изображений, видеоклипов, аудио и стилевых референсов для согласованности персонажей, реквизита и эстетики между сценами.

04

Вердикт

Wan 2.7 — момент, когда генерация видео с открытыми весами повзрослела. Режим Thinking — не трюк: это разница между ИИ, который отвечает на ваш промпт, и ИИ, который его интерпретирует. Контроль первого и последнего кадра, нативный звук, до 9 референсных входов, редактирование по инструкциям: возможности, которых прежде не было или которые были ненадёжны в открытых моделях. И всё это под Apache 2.0 — вы владеете тем, что создаёте с его помощью, полностью. Компромисс — сложность и вычисления. Но для создателей, желающих кинематографического контроля без подписок, Wan 2.7 — наиболее мощная открытая видеомодель из существующих.

05

Часто задаваемые вопросы