免费 · 本机处理

深度图视频生成器

将短视频转换为灰度深度视频。所有处理都在浏览器本地完成,并在可用时使用设备 GPU。

拖入视频,或点击选择文件

MP4、WebM 或 MOV · 最大 50 MB · 处理前 10 秒

输出设置

首次运行会下载约 50 MB 的模型,并缓存在浏览器中。

Depth Anything V2 Small · Apache-2.0

拖入视频,或点击选择文件

本地隐私处理

源视频不会上传至 Z-Image,模型推理与视频编码均在当前设备完成。

稳定的短视频输出

Depth Anything V2 Small 逐帧估算深度,时序平滑可减少亮度闪烁,并在切镜时自动重置。

浏览器兼容性

支持 WebGPU 的 Chrome 或 Edge 速度最快,其他现代浏览器在支持时使用较慢的 WebAssembly 降级。

为什么 AI 视频会使用深度图?

深度序列把场景几何与颜色、纹理分开,为 AI 视频工作流提供更干净的远近、遮挡和运动信号;文本提示或参考图则继续控制主体外观与风格。

保留空间结构

在视频重渲染或更换风格时,让前景、背景和物体边界更容易被下游模型区分。

引导连续运动

帧间稳定的深度可辅助模型理解场景布局、视差和相机运动,减少不自然漂移。

复用几何通道

导出的序列可作为深度条件或遮罩,也能用于景深、雾效、合成和新视角实验。

如何生成深度图视频

1

上传短视频

选择 MP4、WebM 或 MOV 文件,工具只处理前 10 秒。

2

选择速度与细节

360p / 8 FPS 更快,480p / 12 FPS 可保留更多运动细节。

3

处理并下载

浏览器估算、平滑和编码深度帧时,请保持当前页面打开。

深度图视频常见问题

什么是深度图视频?

它是用像素亮度表达相机相对距离的视频序列。常见约定是近处更亮、远处更暗,也可以在本工具中反转这个范围。

深度视频如何用于 AI 视频生成?

兼容的工作流可以把它作为几何条件,与文本提示或参考图一起使用。深度序列负责约束布局和运动,其他输入负责主体外观与风格。

导出的深度序列可以做什么?

常见用途包括视频重渲染、风格迁移、类似 ControlNet 的深度引导、遮罩、景深、雾效、视频合成和新视角生成实验。

这个工具免费吗?

是。免费模式完全在设备本地运行,不消耗 Z-Image 积分。

为什么第一次转换更慢?

浏览器首次需要下载并准备深度模型,后续转换可以复用缓存。

输出是真实距离深度吗?

不是。当前版本输出适合特效和遮罩的相对深度,不代表真实距离。

输出会保留声音吗?

不会。深度图属于分析通道,因此导出视频为静音视频。