Z-Image

Gemini Omni

清晰易用的文生视频与图生视频

通过文字、图片或参考模式创建视频;有视频输入时自动决定时长,无视频时可选 4、6、8 或 10 秒。

0 chars
720p
1080p
4s
16:9
9:16
🎬

生成结果

使用 Z-Video 立即通过文字或图片创建令人惊叹的视频

预计生成时间 30-60秒

👑生成视频需开通会员

Gemini Omni 在本站能做什么

Gemini Omni 是一款多模态视频模型,可以从提示词、单张图片、多张视觉参考素材或一段已有视频开始创作。当画面运动和场景方向需要跟随现有素材,而不是完全从文字出发时,它尤其有价值。

本页面目前开放 Gemini Omni Video 工作流,支持 720p 或 1080p,以及 16:9 或 9:16。KIE 还提供独立的 Audio 和 Character 资产接口,但它们用于创建可复用 ID,并不是另外两个视频模型;本站暂未开放这些能力,4K 也仍在暂缓范围。

选择合适的视频输入

不同输入代表不同控制方式。上传素材前,先判断你需要的是原创场景、外观连续性,还是运动与场景进程的连续性。

01

文生视频

描述主体、动作、景别、运镜、环境、光线和结尾状态。没有视频输入时,可以选择 4、6、8 或 10 秒。

02

图片驱动视频

用静态图片约束角色、产品、环境或视觉风格。提示词重点描述运动和镜头变化,不必只重复图片中已经存在的内容。

03

视频参考生成

当结果需要跟随原视频的运动或场景推进时,可上传一段视频。此模式下输出时长由模型自动判断,手动选择的时长不会生效。

适用场景

社交媒体短片
快速视觉概念

参数能力

文字、图片与参考模式
可选 1 个视频;视频占 2 个配额、图片各占 1 个,总配额 7
有视频时输出时长自动,无视频时为 4、6、8 或 10 秒
Audio ID、Character ID 与 4K 暂缓

推荐设置

清晰描述场景与动作
选择适合场景的画面比例

示例提示词

A cinematic drone shot over a misty forest at sunrise, slow camera movement

让视频运动更连贯的提示词方法

把动作写成有明确开端、变化和结尾的短流程,不要堆叠互不相关的视觉想法。
明确运镜方式,例如固定镜头、缓慢推进、跟拍、手持移动或俯拍,让画面节奏更有方向。
为每份参考素材安排一个用途。少量且一致的素材通常比填满所有位置、信息互相冲突更有效。
使用原视频时,分别说明哪些内容要保留、哪些内容要转换;不要依赖手动时长,因为视频输入会让时长自动决定。

Gemini Omni 常见问题

Gemini Omni 最适合制作什么视频?

它适合短广告概念、产品动态、参考素材驱动的故事片段、场景转换、社媒短片和预演内容,尤其适合让文字、图片或原视频共同约束一个连贯结果。

本页面支持哪些输入模式?

可以从文字生成、让单张图片动起来,也可以使用包含图片和一段视频的多模态参考素材。页面中实际显示的控件就是本站当前支持的组合。

为什么上传视频后不能选择时长?

没有视频输入时可以选择 4、6、8 或 10 秒;加入一段原视频后,Gemini Omni 会自动决定输出时长,手动时长参数不再生效。

Gemini Omni 的参考素材数量如何计算?

每次请求共有 7 个参考单位。每张图片占 1 个单位,最多允许的一段视频占 2 个单位。继续添加素材时,界面会根据剩余单位自动限制数量。

当前可以选择哪些输出规格?

本站当前支持 720p 和 1080p,并提供 16:9 与 9:16。虽然上游资料提到 4K,但本轮并未开放。

Gemini Omni Audio 和 Character 与视频模型是什么关系?

它们是独立的资产创建接口,用于生成可被兼容工作流引用的 Audio ID 或 Character ID,并不是独立视频生成模型。本站暂未在此页面开放这类 ID 功能。

相关模型

Z-Image 是独立的生成平台,与模型提供方不存在隶属或官方背书关系。