Большинство видеогенераторов начинается с рычага: введите промпт, потяните и надейтесь на удачу. Если одна рука расплавилась, тяните снова — и снова платите. Seedance 2.5 пытается заменить это казино съёмочной площадкой. Она даёт автору больше времени, больше референсов, синхронный звук и способы починить отдельный фрагмент, не выбрасывая всё вокруг.
Главная цифра — тридцатисекундное полотно за один проход. Сама по себе длительность ещё не означает рассказ: камера наблюдения может снимать часами, не превращая запись в кино. Но тридцать связанных секунд дают место для появления героя, действия, реакции и завершения. Короткие модели могут имитировать такую структуру склейкой. Seedance способна попытаться создать её внутри одного сгенерированного дубля, где персонаж, свет, ритм и звук исходят из общего контекста.
Для производства ещё важнее система референсов. В одну задачу можно передать до тридцати изображений, десяти видео и десяти аудиоклипов. Представьте эти файлы как небольшую съёмочную группу. Одно изображение отвечает за кастинг, другое — за костюм, видеоклип показывает хореографию, а аудиопример задаёт голос или темп. Черновой 3D-рендер может служить разметкой на сцене: показать путь героя и камеры до того, как модель добавит материалы, свет и атмосферу.
Однако больше данных может означать и больше путаницы. Если два референса по-разному изображают комнату или подпись на сториборде похожа на вывеску, которая должна находиться в кадре, модели приходится угадывать, какая подсказка главная. Seedance бывает настолько буквальной, что сохраняет противоречие. Поэтому хорошая режиссура назначает каждому референсу свою роль, а не вываливает перед моделью чемодан материалов в надежде, что она прочтёт мысли режиссёра.
Звук и видео создаются вместе. Общий внутренний метроном помогает реплике совпасть с движением лица, шагу — прийтись примерно на постановку ноги, а музыке — измениться вместе с планом. Это не гарантирует идеальной синхронизации губ или физики, но устраняет отдельную задачу сборки, при которой одна система отвечает за изображение, а другая — за звук.
Со времени нашего предыдущего обзора доказательная база улучшилась. Arena теперь оценивает эндпоинт Seedance 2.5 720p в 1476±14 — примерно пятое место в снимке text-to-video от 29 августа, с неопределённостью, допускающей ориентировочно места с третьего по седьмое. Это значимый независимый сигнал предпочтений. Artificial Analysis по-прежнему показывает Seedance 2.0, а не 2.5, поэтому нельзя смешивать две системы Elo и две версии модели.
Gemini Omni делает спор за корону сложнее. Более широкое семейство Omni показывает превосходные результаты в независимых слепых сравнениях, а Omni 1.1 добавляет разговорное редактирование, ключевые кадры, дешёвые черновики и прозрачные цены по разрешению. Если спросить: «Какую модель большинству людей стоит открыть первой?», у Omni будут веские доводы. Seedance остаётся у нас на #1, потому что рейтинг учитывает производственный контроль: более длинный единый проход, намного больший набор референсов и процессы, построенные вокруг режиссируемых сцен, а не быстрых разговорных вариантов.
Ограничения напоминают обычные проблемы кинопроизводства в странной новой одежде. В длинном клипе больше времени, чтобы личность героя поплыла, пальцы изменились, объекты прошли друг сквозь друга или жест нескольких людей стал неоднозначным. Фильтры могут отклонить материал, который принимает более старая версия или другой поставщик. Стоимость и поведение очереди зависят от площадки. Нативное 4K нельзя обещать как универсальную возможность: поставщик может предлагать апскейл или разрешение, которое основные материалы ByteDance не гарантируют повсюду.
Выбирайте Seedance для рекламы, эмоциональной актёрской игры, превизуализации, диалоговых сцен и работы по референсам, где дополнительный контроль окупает более медленные или дорогие итерации. Omni лучше, когда нужен широкий процесс Google, понятная стоимость API и разговорная правка. Полезный рейтинг должен показывать эту развилку, а не притворяться, будто одним числом можно срежиссировать любой фильм.