
MiniMax H3 Max AI動画ジェネレーター
プロンプトへの忠実度、映像品質、速度を高める追加学習を施したHailuo 03
MiniMax H3 Maxは、MiniMax H3(Hailuo 03)を追加学習したバリアントです。fal Researchがプロンプトへの忠実度と美的品質を高めるようチューニングし、専用推論エンジンと合わせて最適化したことで、5秒の768pクリップを数秒でレンダリングできます。生成される動画にはすべて、画面の内容に合わせたルームトーン、フォーリー、音楽、環境音などの同期音声が付属します。解像度は480pまたは768p、長さは5~15秒、アスペクト比は参照モードのアダプティブを含む7種類から選べます。
LoveGen AIでは、H3 Maxを3つのモードで利用できます。テキストモードは、説明文から21:9~9:16のアスペクト比で完全なクリップを生成します。画像モードは開始フレームに動きを付け、任意の終了フレームと組み合わせて最初から最後までの変化をコントロールできます。出力のアスペクト比は元画像と同じです。参照モードは最大9枚の画像(プロンプト内でImage 1、Image 2と指定)、動きの参考にする動画3本、音声3本に対応し、参照した動きや音を取り入れながら被写体の一貫性を保ちます。内蔵のプロンプト強化機能が生成前にプロンプトを改善します。バランスなら約1秒で処理が完了し、高品質は最大30秒かけてより詳細なプロンプトを作ります。サブスクリプションは不要で、生成した分だけ支払えます。
MiniMax H3 Max の使い方
ステップ1:モードを選ぶ
プロンプトから生成するならテキスト、写真を動かすなら画像(必要に応じて終了フレームを追加して変化を制御)、最大9枚の画像と参照動画・音声で内容を指定するなら参照を選びます。
ステップ2:プロンプトと設定を入力する
シーンと動きを記述し、解像度(480pまたは768p)、長さ(5~15秒)、アスペクト比、プロンプト強化のレベルを選びます。参照モードでは、素材をImage 1、Video 1、Audio 1としてプロンプト内で指定します。
ステップ3:生成してダウンロードする
「生成」をクリックすると、H3 Maxが同期音声付きの動画を数秒でレンダリングします。ブラウザでプレビューし、準備ができたらMP4をダウンロードします。
MiniMax H3 Max 技術仕様
| 提供元 | MiniMax(fal Researchによる追加学習) |
| リリース日 | 2026年8月 |
| 解像度 | 480pおよび768p(16:9で1344×768、24 fps) |
| 動画の長さ | 5~15秒 |
| アスペクト比 | 21:9、16:9、4:3、1:1、3:4、9:16(参照モードでは自動調整も選択可能。画像モードでは最初のフレームに従います) |
| 音声生成 | ネイティブ同期音声:ルームトーン、フォーリー、音楽、環境音 |
| 入力モード | テキスト、画像(最初/最後のフレーム)、参照素材から動画を生成 |
| 参照入力 | 画像9枚、動画3本、音声3本まで(合計12ファイル以内) |
MiniMax H3 Max を選ぶ理由
プロンプトに忠実、しかも高速
プロンプト忠実度を高める追加学習により、記述したとおりのショットが得られます。さらに専用推論エンジンが5秒の768pクリップを数秒でレンダリングするため、待つ代わりにアイデアを試行錯誤できます。
ネイティブの同期音声
すべてのクリップに、画面上のアクションに合わせたルームトーン、フォーリー、音楽、環境音が付属します。別途音声を編集する必要はなく、追加料金もかかりません。
キーフレームと参照によるコントロール
最初と最後のフレームを組み合わせて制御されたトランジションを作ったり、プロンプト内で直接指定する最大9枚の参照画像、3本の動画クリップ、3本の音声で被写体・動き・音を固定できます。
MiniMax H3 Max と他のAI動画ジェネレーターの比較
| Feature | MiniMax H3 Max | MiniMax H3 | Wan 3.0 | Seedance 2.5 |
|---|---|---|---|---|
| 提供元 | MiniMax + fal Research | MiniMax | Alibaba | ByteDance |
| 最大解像度 | 768p | 2K | 1080p | 720p |
| 最大再生時間 | 15秒 | 15秒 | 30秒 | 30秒 |
| ネイティブ音声 | 対応 | 対応 | 対応 | 対応 |
| 入力モード | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像、参照 |
| 最適な用途 | プロンプト忠実度とスピード | 2Kのディテールとリアリズム | 1080p品質とスマートな尺調整 | 長尺クリップと高い再現性 |
MiniMax H3 Max で作れるもの
トレンド・ソーシャルコンテンツ
トレンドのアイデアを数秒で音声付きの9:16クリップに。トレンドがまだ伸びているうちに投稿できる速さです。
製品・広告クリップ
最初から最後へのキーフレーム制御と、シーンを引き立てる環境音で、製品写真を短いプロモ動画にアニメーション化します。
高速な絵コンテ作成
テキストプロンプトからショットを素早く試行錯誤し、高品質のプロンプト強化で複雑なシーンを肉付けしてから本格的な制作に進めます。
キャラクターの一貫性
参照画像を使い、プロンプト内で Image 1、Image 2 として引用しながら、複数のクリップにわたってキャラクターやスタイルの一貫性を保ちます。
モーション転送
短い参照クリップを与えれば、H3 Max がそのモーション — ダンス、ジェスチャー、カメラワーク — をあなたの被写体で再現します。
サウンド主導のクリップ
画像や動画とあわせて参照音声を追加してリップシンク、リズム、ムードをコントロールするか、すべての生成に付属するネイティブのサウンドトラックをそのまま活用できます。
関連するAI動画ジェネレーターを見る

MiniMax H3
テキスト・画像・参照素材から最長15秒の2K動画を生成する、オリジナルのHailuo 03。

Wan 3.0
スマートな尺調整、ネイティブ音声、参照モードを備えたAlibabaのフラッグシップ1080p動画モデル。

Seedance 2.5
ネイティブ音声、参照モード、最長30秒の再生時間を備えた ByteDance のフラッグシップ動画モデル。

Flux 3
FLUX ファミリーがマルチモーダルに — テキスト・画像・最初/最後のフレームから、ネイティブ音声付きの動画を生成。
Kling 3.0
複数ショット生成とネイティブ音声に対応した、映像制作向けの動画モデル。

Veo 3.1
解像度コントロールを備えた Google DeepMind の先進的な動画モデル。
MiniMax H3 Maxのよくある質問
MiniMax H3 Maxとは何ですか?
MiniMax H3 Maxは、MiniMax H3(Hailuo 03)を追加学習したバリアントです。fal Researchがプロンプトへの忠実度と美的品質を高めるようチューニングし、専用推論エンジンと組み合わせたことで、同期音声付きの動画をオリジナルよりはるかに高速にレンダリングします。LoveGen AIでは、テキスト・画像・参照素材から480pまたは768pで5~15秒のクリップを生成できます。
H3 MaxはMiniMax H3と何が違いますか?
H3 Maxはプロンプトにより忠実に従い、より洗練された映像を生成し、レンダリング時間も大幅に短縮されています。5秒の768pクリップなら数秒で完成します。トレードオフは解像度で、H3 Maxは最大768p、オリジナルのH3は2Kでレンダリングします。素早い試行錯誤と確実なプロンプト追従が必要ならH3 Max、最大解像度が必要ならH3を選んでください。
MiniMax H3 Maxは音声を生成しますか?
はい。すべての動画に、シーンに合わせたルームトーン、フォーリー、音楽、環境音などの同期音声が追加料金なしで付属します。参照モードでは、最大3本の音声を追加してリズム、ムード、リップシンクを誘導することもできます。
プロンプト強化とは何ですか?
H3 Maxは生成前にプロンプトをより詳細な説明へ改善します。バランスなら約1秒で処理が完了し、ほとんどのプロンプトに適しています。高品質は最大30秒かけて、複雑なシーンに合うより詳しいプロンプトを作ります。消費クレジットはどちらも同じです。
参照モードはどのように機能しますか?
被写体やスタイルの参考にする画像を9枚まで、動きの参考にする短い動画(1本あたり2~15秒)を3本まで、音声を3本までアップロードできます。合計は12ファイル以内です。各素材は順番にImage 1、Image 2、Video 1、Audio 1としてプロンプト内で指定します。音声だけでは使用できないため、画像または動画を1つ以上追加してください。
料金はどのように決まりますか?
サブスクリプションはなく、クレジットで生成ごとにお支払いいただきます。コストは解像度と再生時間に応じて変動するため、5秒の480pクリップは15秒の768pクリップよりも安くなります。プロンプト強化、アスペクト比、音声によって料金は変わりません。