深度图(免费)——浏览器中视频或图像的深度图

核心要点 (BLUF): 深度图是帧的黑白副本,其中亮度显示与相机的距离:近处的物体较亮,背景逐渐变黑。该工具可以根据您的视频或图像免费构建一个,并且完全在您自己的设备上:该文件从未上传,不收取任何代币费用,并且背后没有付费API。 Depth Anything V2 Small 模型直接在浏览器中运行,因此您可以看到生成的结果,并将完成的视频下载为 MP4 或 WebM。

什么是深度图以及为什么需要深度图

深度图是根据距相机的距离以灰色阴影重新绘制的同一帧。物体越近,像素越亮;背景变黑。没有纹理、没有皮肤、没有面孔——只有场景的几何形状和浮雕。

在两种情况下你需要它。首先,要通过视频生成过滤器:像Seedance这样的模型拒绝可识别的面孔和电影帧,而深度图没有什么可检查的——里面没有面孔。其次,传递相机运动:深度图显示相机移动的位置以及物体的站立方式,模型以相同的运动绘制自己的场景。

一切都在您的设备上运行

该工具永远不会将您的文件发送到我们或其他任何人的服务器。 Depth Anything V2 Small 模型(Apache 2.0 许可证)加载到浏览器一次,然后从缓存中提供服务,计算通过 WebGPU 在显卡上运行。如果 WebGPU 不可用,则会启动 CPU 回退 — 速度较慢,但​​它可以在任何地方工作。

视频帧使用 WebCodecs 进行解码,每个帧都变成一张深度图,然后所有内容都重新组合成具有原始帧速率和浏览器可以处理的最高分辨率的视频。输出为 MP4 或 WebM,无论您的系统支持哪种。该模型不收取任何代币费用:根本没有付费请求。

视频和图像

您可以处理视频和单个图像。使用 按钮选择一个文件或将其直接拖到窗口中。 HEIC、AVIF 或 TIFF 等不常见格式会自动转换 - 就像网站上的其他地方一样,格式不会阻止任何内容。

对于图像,原始分辨率下的结果是 PNG;对于视频来说,它是具有相同帧速率的剪辑。处理时预览可见:框架在准备好时出现,而不仅仅是在文件组装后出现。长跑可以取消。

彩色图和近亮/近暗开关

默认情况下,深度图是黑白的,前景明亮。接近黑暗的开关会翻转刻度——有时这样的小细节读起来更好。为了清晰起见,有彩色地图、Inferno 和 Viridis:它们将距离绘制为渐变,并帮助您查看灰色混合在一起的平面。

速度和限制

分辨率几乎不会影响速度:模型始终以固定的 518×518 计算帧,并且分辨率仅在组装完成的视频时才重要。真正的杠杆是帧数,因此 CPU 上的长剪辑会很慢:一分钟的源可能需要几分钟。

您需要一个现代浏览器 - Chrome 或 Edge。在性能较弱的笔记本电脑上,不要从 4K 开始:从一个短片开始,检查结果,然后拍摄一个更大的文件。

如何获得最佳结果

选择具有清晰几何形状的框架:街道、室内、全高的人。平面的急剧变化和摄像机的移动传递效果最好。如果您需要生成地图,请先制作它,然后将其与您自己的场景描述一起提供给模型。

常见问题

文件真的没有上传吗?

正确的。模型及其权重加载到浏览器中,计算在您的设备上运行。视频和图像永远不会发送到任何地方,并且此模型中没有付费API。

它要多少钱?

没有什么。深度图不收取任何代币费用:工作发生在您的计算机上,而不是我们的服务器上。

为什么处理速度慢?

速度取决于帧数以及是否有 WebGPU。在 CPU 上,长剪辑花费的时间要长很多倍 - 尝试短剪辑或单个图像。

我可以根据照片制作深度图吗?

是的,该工具也接受图像:输出是原始分辨率的 PNG。

视频以什么格式保存?

MP4 (H.264) 或 WebM — 无论您的浏览器支持哪种。保留原始帧速率。

相似模型