Texto para vídeo
Defina assunto, ação, enquadramento, movimento de câmera, ambiente, luz e estado final. Sem vídeo, escolha 4, 6, 8 ou 10 segundos.
Vídeo multimodal com referências
Crie com texto, imagens ou referências. Com vídeo, a duração é automática; sem vídeo, escolha 4, 6, 8 ou 10 segundos.
Crie vídeos incríveis a partir de texto ou imagens instantaneamente com o Z-Video
Tempo estimado: 30-60s
👑Assinatura necessária para geração de vídeo
Gemini Omni é um modelo de vídeo multimodal que pode começar com prompt, imagem estática, várias referências visuais ou um clipe existente. Ele é útil quando movimento e direção da cena precisam seguir material já disponível.
Esta página oferece Gemini Omni Video em 720p ou 1080p e nos formatos 16:9 ou 9:16. As APIs Audio e Character da KIE criam IDs reutilizáveis; não são outros modelos de vídeo e ainda não estão disponíveis aqui. O 4K também foi adiado.
Antes de enviar arquivos, decida se precisa de uma cena original, continuidade visual ou do movimento de um vídeo de origem.
Defina assunto, ação, enquadramento, movimento de câmera, ambiente, luz e estado final. Sem vídeo, escolha 4, 6, 8 ou 10 segundos.
Uma imagem fixa ancora personagem, produto, ambiente ou estilo. Descreva movimento e câmera em vez de apenas repetir o que já aparece.
Envie um clipe quando o movimento ou a progressão da cena devem orientar o resultado. O modelo define a duração automaticamente e ignora a escolha manual.
A cinematic drone shot over a misty forest at sunrise, slow camera movement
Para conceitos curtos de campanha, movimento de produtos, histórias guiadas por referências, transformações de cena, vídeos sociais e pré-visualizações com texto, imagens ou vídeo de origem.
Geração por texto, animação de uma imagem e referências multimodais com imagens e no máximo um vídeo. Os controles visíveis mostram o escopo atual do Z-Image.
Sem vídeo, você escolhe 4, 6, 8 ou 10 segundos. Com um clipe de origem, Gemini Omni calcula a duração automaticamente e o ajuste manual deixa de valer.
Cada solicitação tem sete unidades. Uma imagem usa uma unidade e o único vídeo permitido usa duas. A interface limita novas mídias conforme o espaço restante.
Atualmente 720p e 1080p, em 16:9 ou 9:16. Embora o provedor mencione 4K, ela não está habilitada nesta versão.
São APIs separadas que criam Audio IDs ou Character IDs para fluxos compatíveis, não geradores de vídeo independentes. O Z-Image ainda não oferece esses recursos aqui.
O Z-Image é uma plataforma de geração independente e não possui afiliação ou endosso do fornecedor do modelo.
Explore nossas ferramentas criativas mais populares
Faça upload da imagem, transforme com uma frase
Uma frase, a IA fornece criatividade infinita de comandos.
Faça upload da imagem, obtenha o comando instantaneamente.
Descubra milhares de comandos de IA de alta qualidade.
Combine vários modelos LoRA para criar obras de arte de IA exclusivas
Transforme seu texto em imagens impressionantes instantaneamente.
Explore estilos artísticos curados para suas criações.
Remova fundos de imagens instantaneamente com precisão de IA.
Melhore a resolução da imagem para até 4K/8K.
Estenda imagens para qualquer proporção com outpainting.
Create a new view with continuous 3D camera control.
Split an image into editable transparent layers.
Turn one image into interactive parallax animation.
Converta imagens em arte ASCII personalizável diretamente no navegador.
Transforme GIFs animados em animações ASCII para baixar.
Converta vídeos MP4, WebM ou MOV em vídeos ASCII para baixar.
Crie localmente um vídeo privado de mapa de profundidade no navegador.