SeeDance 2.5 — мультимодальная нейросеть для создания и преобразования видео. Ей можно дать текст, изображения, видеоклипы и аудио, а затем собрать из этих материалов ролик длиной от 4 до 30 секунд. Модель подходит не только для генерации с нуля: она продолжает исходное видео, переносит движение и стиль, связывает первый и последний кадры и может создать звук вместе с изображением.

В одном задании можно использовать до 30 изображений, до 10 видео и до 10 аудиофайлов. Изображения помогают закрепить внешность героя, предмет или окружение; видео показывают нужное движение, монтажный ритм либо работу камеры; аудио задаёт речь, музыку или атмосферу. Текстовый промпт объясняет, какую роль играет каждый материал и каким должен быть итоговый сюжет.
Такой ввод полезен для рекламных сцен, клипов, коротких историй и продолжения готовой съёмки. Вместо длинного словесного описания можно показать модели лицо персонажа, товар, пример движения камеры и звуковую дорожку. SeeDance 2.5 соединяет эти подсказки в один ролик и сохраняет больше деталей, чем генератор, который видит только текст или один стартовый кадр.
В режиме первого и последнего кадра загрузите две картинки: с какой сцены начать и к какой прийти. Модель построит движение между ними. Это удобно для превращений, появления объекта, смены времени суток и перехода между двумя композициями. Кадры должны быть совместимы по героям и геометрии: слишком резкая смена пространства заставит модель придумывать лишние промежуточные события.
Режим референсов нужен, когда важнее сохранить персонажа, предмет, стиль или движение. Файлы можно упоминать в промпте как @Image1, @Video1 и @Audio1 — порядок виден рядом с загрузкой. У каждого референса должна быть одна понятная функция. Чем яснее вы напишете, что взять из конкретного файла, тем меньше вероятность, что модель смешает одежду, фон и действие.

SeeDance 2.5 умеет продолжать и перерабатывать загруженный клип. Суммарная длительность видеореференсов ограничена 30 секундами, поэтому лучше оставлять только нужный фрагмент. Можно попросить сохранить направление движения, сменить окружение, добавить новый объект или продолжить действие после окончания исходника. При видео-входе цена учитывает и секунды результата, и длительность использованного исходного видео.
Переключатель генерации звука создаёт аудиодорожку вместе с роликом. Опция последнего кадра возвращает отдельное изображение финальной сцены — его удобно использовать как начало следующего клипа. Веб-поиск помогает модели уточнять актуальные сведения, когда они действительно нужны сюжету. Для обычной художественной сцены его лучше не включать: точный визуальный промпт и референсы важнее случайного внешнего контекста.
Начните с действия: кто находится в кадре, что происходит и чем сцена заканчивается. Затем задайте место, свет, настроение и стиль. После этого опишите камеру — общий или крупный план, статичный кадр, панорама, наезд или следование за героем. В конце укажите ограничения: что нельзя менять, какие детали должны сохраниться и из какого референса их брать.
Для ролика с несколькими сценами полезна короткая временная разметка: «0–4 секунды — герой входит, 4–8 — берёт предмет, 8–12 — камера приближается». Не перегружайте четыре секунды длинным сюжетом: физически невозможное количество действий приводит к скачкам. Сначала сделайте короткий черновик в 480p, уточните композицию и движение, а финальную версию запускайте в 720p.
На странице NeuralSpace доступны ролики от 4 до 30 секунд, разрешения 480p и 720p, разные соотношения сторон и выход в MP4 или MOV. Вертикальный кадр подходит для Reels, Shorts и TikTok, широкий — для рекламы и презентаций, квадратный — для лент и карточек. Итоговая стоимость показывается до запуска и зависит от длительности, разрешения и продолжительности входных видео.
Модель особенно полезна для товарных роликов по фотографиям, постоянного героя в серии публикаций, оживления раскадровки, видеопродолжения готового клипа и сцен под музыку или речь. Все результаты сохраняются в истории NeuralSpace. Удачный промпт можно повторить с другими референсами, а возвращённый последний кадр — подать на вход следующей генерации, чтобы собрать длинную последовательность.
Да. Референсы не обязательны, но изображения, видео и аудио делают результат более управляемым, когда нужно сохранить конкретного героя, товар, движение или ритм.
На этой странице версия 2.5 поддерживает ролики до 30 секунд, до 30 изображений, 10 видео и 10 аудиофайлов, генерацию звука, возврат последнего кадра, веб-поиск и форматы MP4 или MOV.
480p удобно для быстрых и более дешёвых черновиков. 720p берите для финального ролика, когда движение, композиция и промпт уже проверены.
Да. Загрузите клип как видеореференс и подробно опишите продолжение. Общая длительность всех входных видео не должна превышать 30 секунд.