Texto a vídeo
Define sujeto, acción, plano, movimiento de cámara, entorno, luz y estado final. Sin vídeo puedes elegir 4, 6, 8 o 10 segundos.
Texto a vídeo e imagen a vídeo nítidos
Crea desde texto, imágenes o referencias. Con vídeo, la duración es automática; sin vídeo, elige 4, 6, 8 o 10 segundos.
Crea vídeos impresionantes a partir de texto o imágenes al instante con Z-Video
Tiempo estimado: 30-60s
👑Se requiere membresía para generar videos
Gemini Omni es un modelo de vídeo multimodal que puede partir de un prompt, una imagen fija, varias referencias visuales o un clip existente. Resulta útil cuando el movimiento y la dirección de la escena deben seguir material previo.
Esta página ofrece Gemini Omni Video en 720p o 1080p y en 16:9 o 9:16. Las API Audio y Character de KIE crean identificadores reutilizables; no son otros modelos de vídeo y todavía no están habilitadas aquí. El 4K también queda aplazado.
Antes de subir material, decide si necesitas una escena original, continuidad visual o el movimiento de un vídeo de origen.
Define sujeto, acción, plano, movimiento de cámara, entorno, luz y estado final. Sin vídeo puedes elegir 4, 6, 8 o 10 segundos.
Una imagen fija ancla personaje, producto, entorno o estilo. Describe el movimiento y la cámara en vez de repetir solo lo que ya se ve.
Sube un clip cuando su movimiento o progresión deba orientar el resultado. El modelo decide automáticamente la duración y omite la elección manual.
A cinematic drone shot over a misty forest at sunrise, slow camera movement
Para conceptos de campaña, movimiento de producto, historias guiadas por referencias, transformaciones de escena, clips sociales y previsualizaciones con texto, imágenes o vídeo de origen.
Generación desde texto, animación de una imagen y referencias multimodales con imágenes y un máximo de un vídeo. Los controles visibles reflejan el alcance actual de Z-Image.
Sin vídeo eliges 4, 6, 8 o 10 segundos. Con un vídeo de origen, Gemini Omni calcula la duración automáticamente y el ajuste manual deja de aplicarse.
Cada solicitud dispone de siete unidades. Una imagen consume una y el único vídeo permitido consume dos. La interfaz limita los medios según la capacidad restante.
Actualmente 720p y 1080p, en 16:9 o 9:16. Aunque el proveedor menciona 4K, no está habilitado en esta versión.
Son API para crear Audio IDs o Character IDs reutilizables en flujos compatibles, no generadores de vídeo independientes. Z-Image aún no muestra esas funciones.
Z-Image es una plataforma de generación independiente y no está afiliada ni respaldada por el proveedor del modelo.
Explore nuestras herramientas creativas más populares
Cargue una imagen, transfórmela con una frase
Una frase, la IA proporciona creatividad infinita para sus mensajes.
Cargue una imagen, obtenga el mensaje al instante.
Descubra miles de mensajes de IA de alta calidad.
Combina múltiples modelos LoRA para crear obras de arte de IA únicas
Convierta su texto en imágenes impresionantes al instante.
Explora estilos artísticos seleccionados para tus creaciones.
Elimina fondos de imágenes al instante con precisión de IA.
Mejora la resolución de la imagen hasta 4K/8K.
Expande imágenes a cualquier relación de aspecto con outpainting.
Create a new view with continuous 3D camera control.
Split an image into editable transparent layers.
Turn one image into interactive parallax animation.
Convierte imágenes en arte ASCII personalizable directamente en el navegador.
Convierte GIF animados en animaciones ASCII descargables.
Convierte vídeos MP4, WebM o MOV en vídeos ASCII descargables.
Crea un vídeo de mapa de profundidad privado y local en el navegador.