自然言語による演出
シーン、動き、カメラ、スタイル、照明、変換内容を1つのプロンプトで説明します。
Gemini Omni マルチモーダル動画
プロンプトと視覚的な参照から動画を作成するか、自然言語で既存クリップを変換できます。出力設定を選び、非同期の結果を確認できます。
出力
ここに動画が表示されます
プロンプトを入力し、任意の参照素材を追加してGemini Omniタスクを送信してください。
モデルについて
Gemini Omniは、文章のプロンプト、参照画像、任意の元動画をまとめて理解できるマルチモーダルAI動画ジェネレーターです。
テキストと画像から新しい動画を作るほか、変更する要素と一貫して保つ要素を指示しながら既存映像を変換できます。
ページはリクエストをKieの非同期タスクとして送信・追跡し、完成動画を認証済みのプレビューとダウンロード用に非公開保存します。
マルチモーダルな動画演出
自然言語と視覚的な文脈を組み合わせ、配信先に合う出力設定を選べます。
シーン、動き、カメラ、スタイル、照明、変換内容を1つのプロンプトで説明します。
画像で見た目をガイドし、必要に応じて変換・編集する元動画を1本追加できます。
横長または縦長、720p・1080p・4Kを選択し、元動画がない場合は長さも設定できます。
Kieタスクを確認し、完成動画を非公開のプレビュー・ダウンロードリンクから利用できます。
3つのステップ
明確な指示と必要な視覚情報を与え、完成結果を確認します。
被写体、動作、見た目、カメラを定義し、編集時は維持すべき内容も指定します。
参照画像や任意の元動画を追加し、利用できる比率、解像度、長さを選びます。
マルチモーダルタスクを送信・追跡し、非公開で保存された出力を確認します。
参照素材を厳選し、求める変化をすべて明確に記述します。
よくある質問
プロンプトと参照画像から動画を作成するか、自然言語の指示でアップロード動画を変換できます。
最大7メディア単位に対応します。画像は1単位、任意の元動画は2単位なので、動画と一緒なら画像は最大5枚です。
元動画がなければ4、6、8、10秒を選べます。元動画を追加すると、出力時間はGemini Omniが自動で決定します。
Kieタスクの成功後、FramePackが結果を非公開で保存し、認証済みのプレビュー・ダウンロードリンクを提供します。
プロンプトと目的のある視覚参照を組み合わせ、Gemini Omniで次の動画を作成しましょう。
Gemini Omniで作成