手元の素材から始める
画像、動画、音声をそのまま使えるため、被写体や動き、演技をテキストだけで一から説明する必要がありません。
プロンプトに画像、動画、音声の参照素材を組み合わせ、ネイティブ最大2K・同期ステレオ音声付きの4〜15秒動画を生成できます。
プロンプトだけで始めることも、画像、開始・終了フレーム、動画、音声を参照素材として追加することもできます。
| 生成モード | テキストから動画、画像から動画、開始・終了フレーム、マルチモーダル参照 |
|---|---|
| 解像度 | ネイティブ最大2K |
| 長さ | 4〜15秒 |
| フレームレート | 24 fps |
| 音声 | ネイティブ同期ステレオ |
| 参照素材の上限 | 1回の生成につき画像9枚、動画3本、音声ファイル3点まで |
| 技術的な強み | 高い指示追従性、文字やブランド要素の再現、動画間のモーション転送、商用制作に使える映像品質 |
| 比較項目 | 現在のモデル MiniMax H3 | Google Veo 3.1 | Seedance 2.0 |
|---|---|---|---|
| 開発元 | MiniMax | Google DeepMind | ByteDance |
| ネイティブ生成解像度 | 標準2K | 720p、1080p、4K | 480p、720p、1080p、4K |
| 1クリップの長さ | 4〜15秒 | 4秒、6秒、8秒 | 最大15秒 |
| 入力形式 | テキスト、画像、動画、音声 | テキスト、画像 | テキスト、画像、動画、音声 |
| 参照素材の上限 | 画像9枚、動画3本、音声3点まで(合計12ファイル) | 参照画像3枚まで | 画像9枚、動画3本、音声3点まで |
| 音声出力 | ネイティブ同期ステレオ | ネイティブ音声 | 2チャンネル音声 |
| 編集と延長 | 指定箇所の動画編集 | シーン延長と開始・終了フレーム生成 | 指定箇所の動画編集と延長 |
| カメラと動きの制御 | プロンプトによるカメラワークとモーション転送 | プロンプトによるカメラワーク | プロンプトによるカメラワークとモーション転送 |
| 人物の一貫性 | 複数画像とマルチモーダル参照 | 被写体の参照画像3枚まで | 複数画像と動画参照 |
| マルチショット制作 | 4〜15秒のクリップ内で複数ショットを生成 | 別々のクリップをつないでシーケンスを作成 | 最大15秒のネイティブマルチショットシーケンス |
既存素材から続きを作ることも、最初からやり直さずにショットの一部だけを変更することもできます。
画像、動画、音声をそのまま使えるため、被写体や動き、演技をテキストだけで一から説明する必要がありません。
周囲のコンテキストを保ちながら、人物、物体、環境、動作、声、タイムラインの一部を再生成できます。
高い指示追従性、読みやすい文字とブランド要素、同期音声、安定した映像で、継続的なコンテンツ制作を支えます。
参照動画のカメラワーク、参照画像の人物、参照音声の歌声を使い、それぞれを完成動画にどう反映するかMiniMax H3に指示します。

参照動画のヒッチコック式カメラワークを参照画像の人物に適用し、参照音声の声で歌わせてください。
MiniMax H3の人気レビュー、比較動画、クリエイターによる実機テストを紹介します。
Xで共有された公開直後の反応、独立ランキング、商用テストを紹介します。
AI動画、画像、またはその両方。制作スタイルに合ったVidLuxプランをお選びください。
年額$276を一括請求
年額$408を一括請求
年額$924を一括請求
生成モード、出力設定、参照ファイル、クレジットに関するよくある質問です。

VidLuxでネイティブ同期音声付きの高品質な動画を生成できます。