VEO 3.1 — 带声音的人工智能视频生成器

核心要点 (BLUF): VEO 3.1 是一款 AI 视频生成器,可根据文本或照片构建剪辑,并以帧中带有音频的逼真运动而闻名。用简单的文字描述一个场景或上传图像,模型会返回一个短视频,其中动作感觉自然,声音可以与动作相匹配。三个质量等级让您可以交换速度、成本和抛光度。

静态风景照片动画化为移动的云朵和摇曳的树木

VEO 3.1 的作用

该模型有两个方向。文本转视频:您写出场景、主题、摄像机移动,然后 VEO 3.1 拍摄您的脚本。图像转视频:您上传一两张图片,静止的画面就变成了生动的场景——树叶摇曳、车流流动、肖像转头。

音频是突出的功能。与大多数视频模型不同,VEO3.1可以生成带有内置配乐的剪辑:街头氛围、效果,甚至适合场景的对话台词。有时,某个剪辑会安静下来——这是模型的一个怪癖,而不是错误,重新运行通常会修复它。

精简、快速或质量:选择一个级别

提供三代级别。当您想要进行多次廉价尝试时,Lite 是草图和想法测试的预算选项。快速是主力——可靠的输出和快速的周转,足以满足大多数日常工作。质量为最终版本提供最佳图像。

定价取决于层级和剪辑参数,这些参数是从整个网站共享的一个代币余额中得出的。将其视为编辑中的草稿和最终渲染:在 Lite 或 Fast 上进行探索,然后在知道它有效后重做 Quality 上的获胜提示。

显示 Lite、Fast 和 Quality 生成模式的质量层选择器

将照片变成视频

上传图片,即成为开场框;然后你的文字会指导接下来发生的事情——树枝开始移动,摄像机推入,有人回头看了一眼。这就是风景、室内设计、产品照片和家庭老照片的生动呈现方式。

对于两张图像,模型将第一张图像视为起始帧,将第二张图像视为结束帧,然后在它们之间建立连贯的过渡。这是转换剪辑的现成配方:产品前后、白天变成夜晚、草图变成成品。

长宽比、延伸和链接剪辑

设置包括 16:9 横向、9:16 纵向以及模型自行选择比例的自动选项。每个完成的视频都会保存到您的生成历史记录中,并且可以在您需要时随时下载。

您喜欢的剪辑可以延长,这样故事就可以继续进行,而无需重新开始。您还可以从任何结果中拉出最后一帧,并将其用作下一代的起始图像——这是将短片段拼接成更长、连续序列的简单方法。

模型拒绝什么

VEO 3.1 执行严格的内部标准:它不会生成儿童、虐待动物或成人内容。当某个场景未通过模型的内部审查时,请求也可能会因不太明显的原因而被拒绝——解决方法是重新措辞描述。

拒绝和失败都是免费的:仅针对实际创建的视频扣除代币。如果运行未成功,请简化场景,放弃有争议的元素,然后重试,或切换到不同的质量等级。

常见问题

生成的视频有声音吗?

是的 — VEO 3.1 可以生成具有与场景匹配的氛围、音效甚至对话的剪辑。有些跑步会安静下来;有些跑步会安静下来。如果发生这种情况,只需重新生成即可。

Lite、Fast 和 Quality 之间有什么区别?

Lite 是用于草稿和实验的最便宜的层。 Fast 平衡日常工作的速度和质量。质量为最终剪辑呈现最好看的图像。每个剪辑的价格取决于您选择的级别。

我可以制作 Reels 和 Shorts 的垂直视频吗?

是的。在设置中选择 9:16 纵向格式 - 专为卷轴、短片和故事而设计。风景 16:9 也有,还有一个自动模式,可以让模型选择比例。

相似模型