テキストから動画
被写体、動作、画角、カメラ移動、環境、光、最後の状態を指定します。動画入力がなければ4、6、8、10秒から選べます。
参照対応のマルチモーダル動画生成
テキスト、画像、参照から生成します。動画入力時は長さが自動で、動画なしでは4・6・8・10秒を選べます。
Z-Videoを使用して、テキストや画像から即座に素晴らしいビデオを作成します
推定生成時間 30-60秒
👑ビデオ生成にはメンバーシップが必要です
Gemini Omniは、プロンプト、静止画、複数の視覚参照、既存動画のいずれからでも始められるマルチモーダル動画モデルです。動きやシーンの方向性を手持ち素材に合わせたいときに有効です。
このページではGemini Omni Videoを720pまたは1080p、16:9または9:16で利用できます。KIEのAudio APIとCharacter APIは再利用可能なIDを作る別機能であり、別の動画モデルではありません。これらと4Kは現在未対応です。
新しいシーン、見た目の一貫性、元動画の動きのどれを重視するか決めてから素材を追加してください。
被写体、動作、画角、カメラ移動、環境、光、最後の状態を指定します。動画入力がなければ4、6、8、10秒から選べます。
静止画で人物、製品、環境、スタイルを固定します。画像の説明を繰り返すより、動きとカメラの変化を記述してください。
元動画の動きやシーン進行を引き継ぎたい場合は1本アップロードします。出力時間は自動決定され、手動設定は無効です。
A cinematic drone shot over a misty forest at sunrise, slow camera movement
短い広告コンセプト、製品の動き、参照主導の物語、シーン変換、SNS動画、テキスト・画像・元動画を使ったプリビジュアライゼーションに適しています。
テキスト生成、1枚の画像のアニメーション、画像と最大1本の動画を含むマルチモーダル参照に対応します。表示される操作項目が現在の対応範囲です。
動画なしでは4、6、8、10秒を選べます。元動画を追加するとGemini Omniが出力時間を自動決定するため、手動設定は適用されません。
1回の要求は7単位です。画像は1枚につき1単位、許可される1本の動画は2単位です。画面が残り容量に応じて追加数を制限します。
720pと1080p、16:9と9:16に対応します。上流資料にある4Kは、このリリースでは有効ではありません。
互換ワークフロー向けのAudio IDやCharacter IDを作る別のアセットAPIで、独立した動画生成モデルではありません。このページではまだ利用できません。
Z-Image は独立した生成プラットフォームであり、モデル提供元との提携や公式な推奨関係はありません。
最も人気のあるクリエイティブツールを探索
画像をアップロードし、一文で変化させます。
一言で、AIが無限のプロンプトの創造性を提供します。
画像をアップロードして、すぐにプロンプトを取得。
数千の高品質なAIプロンプトを発見。
複数のLoRAモデルを組み合わせて、独自のAIアートワークを作成します
テキストを即座に素晴らしい画像に変換します。
あなたの作品のために厳選されたアーティスティックスタイルを探索しましょう。
AIで背景を瞬時に削除し、高精度な切り抜きを実現。
画像を4K/8Kにアップスケールし、細部を鮮明に復元。
AIアウトペインティングであらゆる比率に背景を拡張。
Create a new view with continuous 3D camera control.
Split an image into editable transparent layers.
Turn one image into interactive parallax animation.
ブラウザー内で画像をカスタマイズ可能なASCIIアートに変換します。
アニメーションGIFをダウンロード可能なASCIIアニメに変換します。
MP4、WebM、MOV 動画をダウンロード可能な ASCII 動画に変換します。
ブラウザ内でプライベートな深度動画をローカル生成します。