
MiniMax H3 AI動画ジェネレーター
フロンティア級の2K動画 — 3つの作成方法
MiniMax H3 は Hailuo 03 とも呼ばれる、2026年7月にリリースされた MiniMax のフロンティア動画生成モデルです — シャープでディテール豊かな2K出力とリアルなモーションのために構築されています。テキストプロンプト、1枚の画像、または参照画像・クリップ・音声トラックのセットを、洗練された2K動画へと変換します。再生時間は5〜15秒に設定でき、参照モードのアダプティブフレーミングを含む7種類のアスペクト比から選択できます。
LoveGen AI では、Hailuo 03 を3つの方法で活用できます。テキストから動画では、書かれた説明から 21:9 から 9:16 までのアスペクト比で完全な2Kクリップを生成します。画像から動画では開始フレームをアニメーション化し、任意の終了フレームと組み合わせて最初から最後へのキーフレーム制御が可能で、出力は画像のアスペクト比に従います。参照から動画では最大9枚の参照画像(プロンプト内で Image 1、Image 2 のように引用)、モーション用に最大3本の参照動画クリップ、最大3本の参照音声トラックを受け付け、被写体の一貫性を保ちながら参照したモーションとサウンドに従います。サブスクリプションはなく、生成した分だけお支払いいただきます。
MiniMax H3 の使い方
ステップ1:モードを選ぶ
プロンプトから生成するならテキスト、写真をアニメーション化するなら画像(キーフレーム制御用の任意の終了フレーム付き)、最大9枚の画像に加え参照動画・音声で動画をガイドするなら参照を選びます。
ステップ2:プロンプトと設定を入力する
シーンとモーションを記述し、再生時間(5–15s)とアスペクト比を設定します。参照モードでは、プロンプト内でアセットを Image 1、Video 1、Audio 1 として引用します。
ステップ3:生成してダウンロードする
生成をクリックし、Hailuo 03 に2K動画をレンダリングさせます。ブラウザでプレビューし、準備ができたら MP4 をダウンロードします。
MiniMax H3 技術仕様
| 提供元 | MiniMax |
| リリース日 | July 2026 |
| 解像度 | 2K |
| 動画の長さ | 5–15 seconds |
| アスペクト比 | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16(+ 参照モードでアダプティブ) |
| キーフレーム制御 | 最初から最後へのフレームトランジション(画像モード) |
| 入力モード | テキストから動画、画像から動画(最初/最後のフレーム)、参照から動画 |
| 参照入力 | 最大 9 images、3 videos、3 audio(≤12 total) |
MiniMax H3 を選ぶ理由
フロンティア級の2K品質
Hailuo 03 はすべてのクリップを、クリスプなディテールとリアルなモーションを備えた2Kでレンダリングします — 多くのAI動画モデルの 720p〜1080p 出力から明確なステップアップです。
キーフレームと参照によるコントロール
生成を正確にコントロール:最初と最後のフレームを組み合わせて制御されたトランジションを作ったり、プロンプト内で直接引用する最大9枚の参照画像で被写体とスタイルを固定できます。
モーションと音声の参照
短い動画クリップを与えてモーションを転送し、音声トラックでムードやリップシンクをコントロール — 参照素材に従いながらキャラクターの一貫性を保ちます。
MiniMax H3 と他のAI動画ジェネレーターの比較
| Feature | MiniMax H3 | Seedance 2.0 Mini | Flux 3 | Veo 3.1 |
|---|---|---|---|---|
| 提供元 | MiniMax | ByteDance | Black Forest Labs | Google DeepMind |
| 最大解像度 | 2K | 720p | 720p | 1080p |
| 最大再生時間 | 15s | 15s | 15s | 8s |
| ネイティブ音声 | 音声参照経由 | 対応 | 対応 | 対応 |
| 入力モード | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像、参照 | テキスト、画像 |
| 最適な用途 | 2Kのディテールとリアリズム | スピードとコスト | マルチモーダル制作 | フォトリアリズム |
MiniMax H3 で作れるもの
トレンド・ソーシャルコンテンツ
クリスプな2Kで TikTok、Reels、Shorts をすばやく作成 — トレンドが生まれたその日に乗るのに最適です。
製品・広告クリップ
最初から最後へのキーフレーム制御で、製品写真を洗練された演出の短い2Kプロモ動画にアニメーション化します。
キャラクターの一貫性
参照画像を使い、プロンプト内で Image 1、Image 2 として引用しながら、複数のクリップにわたってキャラクターやスタイルの一貫性を保ちます。
モーション転送
短い参照クリップを与えれば、Hailuo 03 がそのモーション — ダンス、ジェスチャー、カメラワーク — をあなたの被写体で再現します。
リップシンク・サウンド主導のクリップ
画像や動画とあわせて参照音声を追加し、リップシンク、リズム、ムードをコントロールします。
絵コンテ・プレビズ
本格的な制作に取りかかる前に、テキストプロンプトからシーンやショットを2Kですばやく可視化します。
関連するAI動画ジェネレーターを見る

Seedance 2.0 Mini
ByteDance のより速く、より低コストな動画モデル。テキスト・画像・参照モードとネイティブ音声に対応。

Flux 3
FLUX ファミリーのマルチモーダルモデル — ネイティブ音声付きでテキスト・画像・参照から動画を生成。
Kling 3.0
マルチショットAIとネイティブ音声を備えたディレクター級の動画。

Veo 3.1
解像度コントロールを備えた Google DeepMind の先進的な動画モデル。

Sora 2
OpenAI の先進的なテキストから動画への生成モデル。
Happy Horse 1.0
ネイティブ音声と、テキスト・画像・参照モードを備えたシネマティックなAI動画。
MiniMax H3 よくある質問
MiniMax H3とは何ですか?
MiniMax H3 は Hailuo 03 とも呼ばれる、2026年7月にリリースされた MiniMax のフロンティア動画生成モデルです。リアルなモーションを備えたシャープな2K動画をレンダリングします。LoveGen AI では、テキストから動画、画像から動画、参照から動画に利用でき、再生時間は5〜15秒です。
MiniMax H3 はどの入力モードに対応していますか?
3つです。テキストから動画(プロンプトから生成)、画像から動画(任意の終了フレームを指定して開始フレームをアニメーション化)、参照から動画(最大9枚の参照画像に加え、最大3本の参照動画と3本の参照音声トラックで結果をガイド)。
最初から最後へのキーフレーム制御とは何ですか?
画像モードでは、最初のフレームと任意の最後のフレームの両方をアップロードできます。Hailuo 03 がその間のモーションを生成し、一方の画像からもう一方への制御されたトランジションを実現します — モーフィング、リビール、シーン切り替えに最適です。出力のアスペクト比は最初のフレームに従います。
参照から動画はどのように機能しますか?
被写体とスタイル用に最大9枚の参照画像、モーション用に最大3本の短い動画クリップ(各 2–15s)、最大3本の音声トラックをアップロードできます — 合計で最大12ファイルです。各アセットは順番どおりに Image 1、Image 2、Video 1、Audio 1 としてプロンプト内で引用します。音声だけを参照にすることはできず、画像または動画を1つ以上組み合わせてください。
利用できる解像度、再生時間、アスペクト比は?
すべての動画は2Kでレンダリングされます。再生時間は5〜15秒です。テキストモードでは 21:9、16:9、4:3、1:1、3:4、9:16 に対応し、参照モードではアダプティブフレーミングが加わります。画像モードではアスペクト比はアップロードした画像に従います。
料金はどのように決まりますか?
サブスクリプションはなく、クレジットで生成ごとにお支払いいただきます。コストは再生時間に応じて変動するため、5秒のクリップは15秒のものよりも安くなります。すべての動画は解像度の追加料金なしで2Kレンダリングされます。