Wan 2.6 — универсальная нейросеть для генерации видео: на вход она принимает текст, изображение или другое видео. Один инструмент закрывает три задачи — придумать ролик с нуля по описанию, оживить фотографию или взять за основу существующую запись. Разрешение до 1080p, длительность выбирается в настройках, есть режим ролика из нескольких планов.

Большинство видеомоделей заточены под что-то одно: либо текст-в-видео, либо оживление картинок. Wan 2.6 объединяет режимы, и это удобнее, чем кажется. Не нужно держать в голове, какая модель что принимает, и переносить материалы между инструментами — вы просто загружаете то, что есть, и описываете желаемое.
Смешанный вход раскрывается в рабочих цепочках. Сгенерировали кадр в нейросети для картинок — оживили его здесь же. Получили удачный ролик — использовали его как основу для следующего. Такой конвейер позволяет собирать целые сюжеты, не покидая одну страницу генерации.
Классический режим: пишете сцену словами — получаете движущуюся картинку. Модель понимает развёрнутые описания, где задано место действия, персонажи, движение камеры и атмосфера. «Дрон пролетает над осенним лесом на рассвете, туман между деревьями» — этого достаточно, чтобы получить осмысленный ролик без единого исходного файла.
Секрет качественного промпта — конкретика в динамике. Опишите не только что в кадре, но и что происходит: кто куда идёт, как движется камера, что меняется от начала к концу. Статичные описания дают статичные ролики, а глаголы движения заставляют сцену жить.

Режим с картинкой на входе превращает статичный кадр в сцену. Портрет начинает дышать и поворачивать голову, пейзаж наполняется ветром и движением облаков, товар вращается перед камерой. Фотография задаёт композицию и внешний вид, а промпт — характер движения, поэтому результат предсказуемее чистой текстовой генерации.
Видео на входе открывает третий сценарий: существующая запись становится отправной точкой для новой. Это способ развить уже готовый материал — продолжить действие, изменить происходящее в кадре, переосмыслить сцену. Комбинируя три режима, можно начинать проект с любого ресурса, который оказался под рукой.
В форме выбирается разрешение вплоть до 1080p и длительность будущего ролика. Для черновиков и проверки идей разумно брать настройки поменьше — генерация проходит быстрее и дешевле, а удачный вариант потом можно перегенерировать в максимальном качестве. Цена зависит от длительности и выбранного разрешения.
Отдельного внимания заслуживает переключатель мультишота. В обычном режиме модель генерирует один непрерывный план, а с ним — ролик из нескольких сменяющихся ракурсов, похожий на смонтированную нарезку. Это придаёт результату киношный ритм без ручного монтажа: сцена сама разбивается на планы.
Модель хороша там, где нужен быстрый видеоконтент из подручных материалов: ролики для карточек товаров из фотографий, короткие сюжеты для соцсетей по текстовой идее, анимированные заставки из статичных обложек. Универсальный вход означает, что почти любой актив — снимок, описание, старый ролик — годится как стартовая точка.
Готовые генерации сохраняются в истории: их можно скачать, продлить, вытащить последний кадр для следующей итерации или повторить с исправленным промптом. Такой цикл — сгенерировал, посмотрел, уточнил — быстро приводит к нужному результату даже без опыта работы с видеонейросетями.
Три варианта: только текстовое описание, изображение с промптом или видео как основу. Модель сама подстраивается под тип входа, поэтому подойдёт любой стартовый материал — от одной фразы до готового ролика.
Вместо одного непрерывного плана модель собирает ролик из нескольких сменяющихся ракурсов — как смонтированную сцену. Полезно для сюжетных и рекламных роликов, где смена планов создаёт динамику.
Разрешение выбирается в настройках, максимум — 1080p. Для экспериментов удобнее генерировать в меньшем качестве и быстрее, а финальную версию делать уже в максимальном. Стоимость зависит от длительности и разрешения.