
MiniMax H3 AI動画ジェネレーター
高品質な2K動画を3つの方法で生成
MiniMax H3(別名Hailuo 03)は、MiniMaxが2026年7月にリリースした先進的な動画生成モデルです。細部まで鮮明で、動きの自然な2K動画を生成できます。テキストプロンプト、1枚の画像、または参照画像・動画・音声のセットから、完成度の高い2K動画を作成できます。長さは5~15秒で、参照モードの自動調整を含む7種類のアスペクト比から選べます。
LoveGen AIでは、Hailuo 03を3つのモードで利用できます。テキストモードは、説明文から21:9~9:16のアスペクト比で2K動画を生成します。画像モードは開始フレームに動きを付け、任意の終了フレームを追加して、最初から最後までの変化をコントロールできます。出力のアスペクト比は元画像と同じです。参照モードは最大9枚の画像(プロンプト内でImage 1、Image 2と指定)、動きの参考にする動画3本、音声3本に対応し、参照した動きや音を取り入れながら被写体の一貫性を保ちます。サブスクリプションは不要で、生成した分だけ支払えます。
MiniMax H3 の使い方
ステップ1:モードを選ぶ
プロンプトから生成するならテキスト、写真をアニメーション化するなら画像(キーフレーム制御用の任意の終了フレーム付き)、最大9枚の画像に加え参照動画・音声で動画をガイドするなら参照を選びます。
ステップ2:プロンプトと設定を入力する
シーンや動き、カメラワークを記述し、長さ(5~15秒)とアスペクト比を設定します。参照モードでは、素材をImage 1、Video 1、Audio 1としてプロンプト内で指定します。
ステップ3:生成してダウンロードする
「生成」をクリックして、Hailuo 03が2K動画を完成させるまで待ちます。ブラウザでプレビューし、準備ができたらMP4をダウンロードします。
MiniMax H3 技術仕様
| 提供元 | MiniMax |
| リリース日 | 2026年7月 |
| 解像度 | 2K |
| 動画の長さ | 5~15秒 |
| アスペクト比 | 21:9、16:9、4:3、1:1、3:4、9:16(参照モードでは自動調整も選択可能) |
| キーフレーム制御 | 最初のフレームから最後のフレームへの変化を制御(画像モード) |
| 入力モード | テキスト、画像(最初/最後のフレーム)、参照素材から動画を生成 |
| 参照入力 | 画像9枚、動画3本、音声3本まで(合計12ファイル以内) |
MiniMax H3 を選ぶ理由
細部まで鮮明な2K品質
Hailuo 03はすべてのクリップを2Kで生成し、細部まで鮮明な映像と自然な動きを実現します。多くのAI動画モデルが出力する720p~1080pより、一段上の画質です。
キーフレームと参照によるコントロール
生成を正確にコントロール:最初と最後のフレームを組み合わせて制御されたトランジションを作ったり、プロンプト内で直接引用する最大9枚の参照画像で被写体とスタイルを固定できます。
モーションと音声の参照
短い動画クリップを与えてモーションを転送し、音声トラックでムードやリップシンクをコントロール — 参照素材に従いながらキャラクターの一貫性を保ちます。
MiniMax H3 と他のAI動画ジェネレーターの比較
| Feature | MiniMax H3 | Seedance 2.0 Mini | Flux 3 | Veo 3.1 |
|---|---|---|---|---|
| 提供元 | MiniMax | ByteDance | Black Forest Labs | Google DeepMind |
| 最大解像度 | 2K | 720p | 720p | 1080p |
| 最大再生時間 | 15s | 15s | 15s | 8s |
| ネイティブ音声 | 音声参照経由 | 対応 | 対応 | 対応 |
| 入力モード | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像 |
| 最適な用途 | 2Kのディテールとリアリズム | スピードとコスト | マルチモーダル制作 | フォトリアリズム |
MiniMax H3 で作れるもの
トレンド・ソーシャルコンテンツ
TikTok、Reels、Shorts向けの鮮明な2K動画をすばやく作成し、新しいトレンドにもすぐ対応できます。
製品・広告クリップ
最初から最後へのキーフレーム制御で、製品写真を洗練された演出の短い2Kプロモ動画にアニメーション化します。
キャラクターの一貫性
参照画像を使い、プロンプト内で Image 1、Image 2 として引用しながら、複数のクリップにわたってキャラクターやスタイルの一貫性を保ちます。
モーション転送
短い参照クリップを与えれば、Hailuo 03 がそのモーション — ダンス、ジェスチャー、カメラワーク — をあなたの被写体で再現します。
リップシンク・サウンド主導のクリップ
画像や動画とあわせて参照音声を追加し、リップシンク、リズム、ムードをコントロールします。
絵コンテ・プリビジュアライゼーション
本格的な制作に取りかかる前に、テキストプロンプトからシーンやショットを2Kですばやく可視化します。
関連するAI動画ジェネレーターを見る

Seedance 2.0 Mini
ByteDance のより速く、より低コストな動画モデル。テキスト・画像・参照モードとネイティブ音声に対応。

Flux 3
FLUX ファミリーのマルチモーダルモデル — ネイティブ音声付きでテキスト・画像・参照から動画を生成。
Kling 3.0
マルチショットAIとネイティブ音声を備えたディレクター級の動画。

Veo 3.1
解像度コントロールを備えた Google DeepMind の先進的な動画モデル。

Sora 2
OpenAI の先進的なテキストから動画への生成モデル。
Happy Horse 1.0
ネイティブ音声と、テキスト・画像・参照モードを備えたシネマティックなAI動画。
MiniMax H3 よくある質問
MiniMax H3とは何ですか?
MiniMax H3(別名Hailuo 03)は、MiniMaxが2026年7月にリリースした先進的な動画生成モデルです。細部まで鮮明で、動きの自然な2K動画を生成できます。LoveGen AIでは、テキスト・画像・参照素材から5~15秒の動画を作成できます。
MiniMax H3はどの入力モードに対応していますか?
3つです。テキストモードはプロンプトから動画を生成し、画像モードは開始フレームに動きを付けて任意の終了フレームまで変化させます。参照モードでは、最大9枚の画像、3本の動画、3本の音声で生成結果をコントロールできます。
最初と最後のフレームを指定すると何ができますか?
画像モードでは、最初のフレームに加えて任意の最後のフレームをアップロードできます。Hailuo 03がその間の動きを生成し、2枚の画像を自然につなぎます。モーフィング、商品のお披露目、シーン切り替えなどに便利です。出力のアスペクト比は最初のフレームと同じです。
参照モードはどのように機能しますか?
被写体やスタイルの参考にする画像を9枚まで、動きの参考にする短い動画(1本あたり2~15秒)を3本まで、音声を3本までアップロードできます。合計は12ファイル以内です。各素材は順番にImage 1、Image 2、Video 1、Audio 1としてプロンプト内で指定します。音声だけでは使用できないため、画像または動画を1つ以上追加してください。
利用できる解像度、再生時間、アスペクト比は?
すべての動画は2Kでレンダリングされます。再生時間は5〜15秒です。テキストモードでは 21:9、16:9、4:3、1:1、3:4、9:16 に対応し、参照モードではアダプティブフレーミングが加わります。画像モードではアスペクト比はアップロードした画像に従います。
料金はどのように決まりますか?
サブスクリプションはなく、クレジットで生成ごとにお支払いいただきます。コストは再生時間に応じて変動するため、5秒のクリップは15秒のものよりも安くなります。すべての動画は解像度の追加料金なしで2Kレンダリングされます。