
テキスト・画像から動画生成
テキストプロンプト、画像、またはそれらを組み合わせた参照元から、高品質な映画のような動画を生成します。H3はキャラクター、環境、視覚スタイル、ストーリーの意図を理解し、一貫性のあるシーンを作成します。
ネイティブなマルチモーダル理解でシネマティックな動画を作成。テキスト、画像、モーションリファレンス、カメラガイダンス、音声入力を使用して、動画の生成、編集、変換を行います。
| プロンプト | 参照画像 | 生成されたクリップ |
|---|---|---|
| プロンプト | 参照画像 | 参照ビデオ | 生成されたクリップ |
|---|---|---|---|
| プロンプト | 参照画像 | 参照ビデオ | 生成されたクリップ |
|---|---|---|---|

テキストプロンプト、画像、またはそれらを組み合わせた参照元から、高品質な映画のような動画を生成します。H3はキャラクター、環境、視覚スタイル、ストーリーの意図を理解し、一貫性のあるシーンを作成します。
1つの強力なマルチモーダルAIモデルで、映画のような動画の生成、既存映像の編集、モーション転送、同期された視聴覚体験の作成を実現します。
MiniMax H3を探索する