SeeDance 2.5 是用于生成和改编视频的多模态 AI 模型。你可以同时提供文本、图片、视频和音频,将它们组合成 4 到 30 秒的视频。它不仅能从零生成,还能续写现有片段、参考运动和风格、连接首尾帧,并让画面与声音一起生成。

单个任务最多可使用 30 张图片、10 段视频和 10 个音频文件。图片用来固定人物、商品或环境,视频展示动作、剪辑节奏或运镜,音频提供对白、音乐或氛围。文字提示负责说明每个素材的用途以及最终剧情。
这种组合适合广告、音乐短片、短故事和已有视频的续写。与其用很长的文字描述人物外观、商品和镜头运动,不如直接把参考素材交给模型。SeeDance 2.5 会把它们理解为同一个创作任务,更稳定地保留关键细节。
在首尾帧模式中,上传镜头开始和结束时的两张图,模型会生成中间的运动。它适合变身、物体出现、昼夜变化和两个构图之间的转场。人物和空间结构应尽量兼容,变化过大时模型需要凭空补出太多事件。
需要保持人物身份、商品、风格或动作时,请使用参考素材模式。按照上传区显示的顺序,在提示词中写 @Image1、@Video1 和 @Audio1。让每个素材只承担一个明确作用,并说明要从中采用什么,以免服装、背景和动作互相混淆。

SeeDance 2.5 可以续写或重构上传的视频。视频参考总时长不能超过 30 秒,因此只保留真正需要的片段。你可以要求保持运动方向、更换环境、加入物体,或在原片结束后继续动作。使用视频输入时,价格会同时计算输出和输入视频的时长。
生成声音选项会为画面同时创建音轨。返回尾帧会额外提供结尾画面的静态图,可作为下一段视频的首帧。只有剧情确实需要最新信息时才建议使用联网搜索;虚构画面更依赖清晰的构图、镜头语言和参考素材。
先写动作:谁在画面里、发生什么、最后如何结束。再补充地点、光线、情绪和视觉风格,然后说明镜头,例如全景、特写、固定机位、横移、推进或跟拍。最后列出不能改变的细节,并指出每项细节来自哪个参考。
多段动作可以用简短时间轴,例如“0–4 秒人物入场,4–8 秒拿起物品,8–12 秒镜头推进”。不要把长故事塞进四秒,否则容易跳跃。先用短时长 480p 草稿确认构图和动作,再修改提示词并用 720p 输出最终版本。
NeuralSpace 支持 4 到 30 秒、480p 和 720p、多种画幅,以及 MP4 或 MOV 输出。竖屏适合 Reels、Shorts 和 TikTok,横屏适合广告和演示,方形适合信息流和商品卡。运行前会显示费用估算,价格取决于时长、分辨率和输入视频长度。
典型用途包括用商品照片制作广告、在系列内容中保持同一主角、让分镜图动起来、续写现有视频,以及让画面配合音乐或对白。所有结果保存在 NeuralSpace 历史记录中。你可以用新参考复用成功的提示词,也可以把尾帧用于下一次生成。
可以。参考素材不是必需的,但当人物、商品、动作或节奏必须保持一致时,图片、视频和音频会带来更强控制。
本页的 2.5 流程支持最长 30 秒、30 张图片、10 段视频和 10 个音频,并提供声音生成、返回尾帧、联网搜索及 MP4 或 MOV 输出。
用 480p 制作更快、更省的草稿;确认动作、构图和提示词后,再用 720p 输出最终视频。
可以。将它作为视频参考上传并清楚描述后续内容,所有输入视频的总时长不得超过 30 秒。