詳細なシーン演出
人物、動作、ショット順、カメラ、台詞、音楽、効果音を自然言語で指定します。
MiniMax H3 · Hailuo 03 マルチモーダル動画
テキストから動画を作る、開始フレームと任意の終了フレームを動かす、または画像・動画・音声参照を組み合わせることができます。ネイティブ音声付きの4〜15秒、768Pまたは2K動画を生成します。
出力
ここに動画が表示されます
MiniMax H3のモードを選び、プロンプトと必要な参照を追加して送信してください。
モデルについて
MiniMax H3(Hailuo 03)は、テキスト、画像、動画、音声を1つの文脈で理解するマルチモーダル動画モデルです。
テキスト動画、開始・終了フレーム動画、マルチモーダル参照動画に対応し、4〜15秒の768Pまたは2K動画を出力します。
FramePackはタスクを非同期に追跡し、完成動画を非公開で保存してプレビューとダウンロードに提供します。
統合された映像と音声の制作
プロンプトや複数形式の参照から、同期音声付きの動画を作成します。
人物、動作、ショット順、カメラ、台詞、音楽、効果音を自然言語で指定します。
開始・終了フレーム、または複数の画像・動画・音声を利用できます。
4〜15秒、対応する画角、用途に合う解像度を選択できます。
生成中のタスクを追跡し、完成後に非公開の結果を確認・保存できます。
3つのステップ
ワークフローを選び、各入力の役割を明確にして結果を確認します。
テキスト、開始・終了フレーム、またはマルチモーダル参照から始めます。
プロンプトと参照の役割を書き、長さ、解像度、画角を設定します。
非同期タスクを送信・追跡し、完成した動画をダウンロードします。
構造化した指示により、映像と音声の一貫性が高まります。
よくある質問
テキスト、フレーム、画像・動画・音声参照から4〜15秒の768Pまたは2K動画を生成できます。
画像動画は1〜2枚、参照動画は最大9枚の画像、3本のMP4/MOV、3件のMP3/WAVに対応します。
はい。ネイティブのステレオ音声を生成し、アップロード音声を声・音楽・効果音のガイドにもできます。
生成成功後、FramePackが動画を非公開で保存し、認証済みのプレビューとダウンロードリンクを表示します。
明確なプロンプトと用途のある参照を組み合わせ、MiniMax H3で生成しましょう。
MiniMax H3で作成