文生视频
描述主体、动作、景别、运镜、环境、光线和结尾状态。没有视频输入时,可以选择 4、6、8 或 10 秒。
清晰易用的文生视频与图生视频
通过文字、图片或参考模式创建视频;有视频输入时自动决定时长,无视频时可选 4、6、8 或 10 秒。
使用 Z-Video 立即通过文字或图片创建令人惊叹的视频
预计生成时间 30-60秒
👑生成视频需开通会员
Gemini Omni 是一款多模态视频模型,可以从提示词、单张图片、多张视觉参考素材或一段已有视频开始创作。当画面运动和场景方向需要跟随现有素材,而不是完全从文字出发时,它尤其有价值。
本页面目前开放 Gemini Omni Video 工作流,支持 720p 或 1080p,以及 16:9 或 9:16。KIE 还提供独立的 Audio 和 Character 资产接口,但它们用于创建可复用 ID,并不是另外两个视频模型;本站暂未开放这些能力,4K 也仍在暂缓范围。
不同输入代表不同控制方式。上传素材前,先判断你需要的是原创场景、外观连续性,还是运动与场景进程的连续性。
描述主体、动作、景别、运镜、环境、光线和结尾状态。没有视频输入时,可以选择 4、6、8 或 10 秒。
用静态图片约束角色、产品、环境或视觉风格。提示词重点描述运动和镜头变化,不必只重复图片中已经存在的内容。
当结果需要跟随原视频的运动或场景推进时,可上传一段视频。此模式下输出时长由模型自动判断,手动选择的时长不会生效。
A cinematic drone shot over a misty forest at sunrise, slow camera movement
它适合短广告概念、产品动态、参考素材驱动的故事片段、场景转换、社媒短片和预演内容,尤其适合让文字、图片或原视频共同约束一个连贯结果。
可以从文字生成、让单张图片动起来,也可以使用包含图片和一段视频的多模态参考素材。页面中实际显示的控件就是本站当前支持的组合。
没有视频输入时可以选择 4、6、8 或 10 秒;加入一段原视频后,Gemini Omni 会自动决定输出时长,手动时长参数不再生效。
每次请求共有 7 个参考单位。每张图片占 1 个单位,最多允许的一段视频占 2 个单位。继续添加素材时,界面会根据剩余单位自动限制数量。
本站当前支持 720p 和 1080p,并提供 16:9 与 9:16。虽然上游资料提到 4K,但本轮并未开放。
它们是独立的资产创建接口,用于生成可被兼容工作流引用的 Audio ID 或 Character ID,并不是独立视频生成模型。本站暂未在此页面开放这类 ID 功能。
探索最受欢迎的创意工具
上传图片,一句话即可改变一切。
一句话让AI 为你提供无限提示词创意
上传图片,立即读取提示词
发现成千上万的高质量 AI 提示词。
多 LoRA 组合生成,创造独一无二的 AI 艺术作品。
输入文字,瞬间转化为精美的 AI 绘图作品。
探索为您创作精心挑选的艺术风格。
一键移除图片背景,实现专业级高精度抠图。
将图片无损放大至 4K/8K,恢复清晰细节。
使用 AI 外绘技术将图片扩展至任意比例背景。
使用连续 3D 镜头控制生成自由视角。
将图片拆分为可编辑透明图层。
将一张图片变成可交互的视差动画。
在浏览器本地将图片转换为可自定义的 ASCII 字符画。
将动态 GIF 转换成可下载的 ASCII 字符动画。
将 MP4、WebM 或 MOV 转换为可下载的 ASCII 视频。
在浏览器本地生成私密的深度图视频。