MiniMax H3 Max
必要クレジット
15
動画

MiniMax H3 Max AI動画ジェネレーター:fal上の高速動画生成

ブラウザでMiniMax H3 Maxを実行。プロンプト、または開始・終了フレームから、ネイティブステレオ音声付きの5〜15秒クリップを作ります。MiniMax H3はオープンウェイトのマルチモーダル生成モデル。H3 Maxは、falが速度向けに調整し、当ページでホストしている変種です。

MiniMax H3 MaxでAI動画を作る理由

PixExactはfalのH3 Maxを、シンプルな流れにしています。プロンプトを書き、必要なら画像を足し、同期音声つき動画を一度で生成します。

falのH3 Max、MiniMax H3ベースモデルから

MiniMax H3 Maxは、MiniMaxのオープンウェイトH3動画モデルをポストトレーニングした変種です。fal Researchがプロンプト忠実度と見た目を調整し、自前の推論スタックとサービング経路を共同設計しています。

映像と音声を一回の生成で

H3 Maxは映像とサウンドトラックを同時に予測します。セリフ、効果音、環境音まで入ったネイティブステレオ音声つき動画が得られ、あとから音楽を足す無音クリップではありません。

テキスト→動画と画像→動画

ショットを文章で指定するか、最初のフレームと任意の最後のフレームをアップロード。画像→動画は元画像のアスペクト比に従い、テキスト→動画では16:9、9:16、21:9、4:3、1:1、3:4を選べます。

768pの反復向けに設計

H3 Maxのデフォルトは768p(16:9では1344×768、24 fps)。falによると、5秒の768pクリップは同社スタック上で推論が3秒未満——短いテイクならリアルタイムより速い、とあります。PixExactでは480pと1080pも選べます。

MiniMax H3 Maxで動画を生成する手順

プロンプトからダウンロード可能なクリップまで3ステップ。PixExactではComfyUIのグラフもローカルGPUも不要です。

1

プロンプトを書く

カメラ、動き、音を1本のプロンプトにまとめます。画像→動画では開始フレームを上げ、必要なら終了フレームも。尺、モーション、音声まで具体的に書くほどモデルが追いやすくなります。

2

長さと解像度を選ぶ

クリップは5〜15秒。480p、768p、1080pから選択。768pはfalがH3 Maxを調整した解像度。ショットの試し撮りなら15秒・480pが最も安く済みます。

3

生成してダウンロード

生成をクリック。PixExactがfal上でMiniMax H3 Maxをキューし、同期音声つきクリップを返します。プレビュー、ダウンロード、サイト内の他AIツールへの再利用ができます。

このAI動画生成モデルが得意なこと

H3 MaxはMiniMax H3のマルチモーダルな文脈理解——テキストと画像を1リクエストに——を残しつつ、2K出力を捨てて768pの高速生成に振っています。実務ではこう使えます。

詳細プロンプトでのテキスト→動画

以前のHailuo系チェックポイントより、時間軸のビートを追いやすい——それがfalのポストトレーニングの狙いです。ショットリストは順に:誰が映るか、カメラはどう動くか、何が聞こえるべきか。

5 seconds, 16:9, 768p. A courier on a rain-slick night market alley, slow dolly forward under red neon. Wok sizzle, rain on tin, neon hum. No music.

画像→動画と最初〜最後フレーム

静止画を1フレーム目としてアップロード。終了画像を足すと、H3 Maxがその間の動きを補間します。MiniMaxが先頭・末尾フレームモードとして文書化している画像→動画と同じ経路です。出力比率は渡した画像に従います。

Hold the camera locked. Morning light crawls across the room, dust in the beam, curtains lift once. Soft room tone, a distant kettle.

ネイティブステレオ音声。無音レンダーではない

MiniMax H3は、音声と映像が1回のomni transformerパスを共有する設計です(ベースモデルは32 kHzステレオ)。H3 Maxも同じ:リップシンク、フォーリー、スコアを別音声パイプラインなしで一度に出せます。

A chef looks into camera and says, "Don't crowd the pan." Window daylight, white tile, pan sizzle under her voice. Medium close-up, 50mm.

短いクリップ、5〜15秒

1回の実行で最大15秒、24 fpsのクリップ。SNSカット、商品ループ、アニマティック向きです。ネイティブ2Kが必要なら、MiniMaxとfalの文書が示すのはMiniMaxのH3ベースモデル(H3 Maxではない)です。

15 seconds, 9:16. Pixel-art endless runner along a steep city street, jump and duck on beat, chiptune and jump blips, score HUD in the corner.

MiniMax H3 Maxの活用例

同期音声つきの高速768p動画モデルは、完成長編ではなく、短いテイクをたくさん欲しいときに最も役立ちます。

短いSNSクリップ

Reels、Shorts、TikTok向けに、5〜15秒の縦型またはスクエアを生成。ネイティブ音声があるので、フックに声や効果音を入れて二番目のツールを開かずに済みます。

商品・キャンペーンの試作

スローガン、静止画、先頭と末尾のペアで反復。fal公開例には商品マクロ、モーションポスター、1回の生成に収めたマルチショット広告があります。

イラスト、ピクセルアート、画風の維持

すでに見た目が決まっているなら画像→動画が有効です。falはピクセルアートのランナー、クレイメーション、切り絵をクリップ全体で維持する例を示しています。どのプロンプトでも保証されるわけではありませんが、現実的な使い方です。

アニマティックと複数ショット

H3のマルチモーダル文脈は複雑なブリーフ向けです。複数ビート、崩したくないキャラ、接触に合わせて入る音。長い編集に入る前のプリビズに使えます。

MiniMax H3 よくある質問

MiniMax H3とは?

MiniMax H3は、MiniMaxの汎用マルチモーダル動画生成モデルです。テキスト、画像、動画、音声を1つのコンテキストで読み、ネイティブステレオ音声つき動画(通常5〜15秒)を生成します。MiniMaxはH3-Base omni transformer(約33Bパラメータ)のオープンウェイトをHugging Faceで公開しています。フル2K配信には追加のregenerate段階(H3-Regenerate-2K)が入り、ホストされているContext-IRプリプロセッサはオープンソース配布に含まれていません。

MiniMax H3 Maxとは?

MiniMax H3 Maxは、fal ResearchがMiniMax H3ベースモデルをポストトレーニングした変種で、falの推論スタック上で提供されます。プロンプト忠実度と見た目向けに調整され、デフォルトは768pです。PixExactのMiniMax H3ページは、このH3 Maxでテキスト→動画と画像→動画(任意の最終フレーム含む)を実行します。

MiniMax H3 MaxとMiniMax H3の違いは?

標準のMiniMax H3はMiniMaxのオープンウェイトモデルです。fal上では480p、768p、2K、4Kを扱え(falは2K/4Kを768pベースからのアップスケールと説明)、reference-to-videoや編集系エンドポイントもあります。H3 Maxはfalのクローズドなポストトレインで、768pが速く、別ウェイトの公開はなく、2K/4Kは役割ではありません。このジェネレーターで速度を取るならH3 Max、2Kやフル参照パックが必要ならベースH3を選んでください。

MiniMax H3はHailuo 2.3と同じですか?

いいえ。HailuoはMiniMaxのコンシューマー動画ブランドです。Hailuo 01とHailuo 02は以前の世代。MiniMaxはH3を次の汎用モデルとして位置づけ、hailuoai.videoでデモしています。Hailuo 2.3はfal上でも別ファミリーとして残っています。H3 / H3 MaxとHailuo 2.3は別製品として扱ってください。

MiniMax H3は良いですか?H3 Maxは本当に画像→動画で1位ですか?

どのボードを見るかによります。falはDesign Arenaの画像→動画Elo(そのボードでH3 Maxは1,341)と、Artificial Analysisの画像→動画(音声つき)ランキング(そこではMiniMax H3 Turbo 768pと記載)を引用しています。第三者のリーダーボードであり、PixExactのテストではありません。短い音同期クリップでは品質はしっかりしていますが、あらゆるショットで他モデルの置き換えになるわけではありません。

MiniMax H3は音声を生成しますか?

はい。MiniMax H3もH3 Maxも、映像と一緒に音声を生成します。ネイティブステレオで、プロンプトが求めればセリフ、効果音、音楽も含みます。基本的なテキストまたは画像生成に、別の音声入力は不要です。参照音声はベースH3 / reference-to-video APIの機能で、このPixExactページではまだ公開していません。

MiniMax H3はローカルで動かせますか?ComfyUIでは?

オープンウェイトのH3-Baseチェックポイントはローカル配備できます。MiniMaxはSGLang、vLLM、Diffusers、ComfyUIの手順を公開しています。ComfyUIにはMiniMax H3 APIパートナーノード(クラウド課金)もあり、テキスト→動画、先頭/末尾フレーム、reference-to-videoに対応します。公式のContext-IRと2K regenerateモジュールは最初のオープンソース配布に入っていません。H3 Max自体はfalホストのポストトレインで、オフライン実行できる公開H3 Maxチェックポイントはありません。PixExactはクラウドでH3 Maxを動かしています。

MiniMax H3はオープンソースですか?H3 Maxは公開されますか?

MiniMax H3はオープンウェイト(H3-Base)をMiniMaxのコミュニティライセンスで出荷しています。フルの学習スタックではなく、Context-IRも含みません。厳密な意味での完全なオープンソース公開ではなく、オープンウェイトです。falはH3 Max用の別オープンウェイトを掲載しておらず、公開H3ベースのポストトレインです。H3 Maxのオープンソース予定日は発表されていません。

MiniMaxは中国企業ですか?

はい。MiniMaxは上海拠点のAI企業です(falのMiniMax explorerはShanghai, Chinaと記載)。言語、音声、音楽、動画モデルを開発しており、Hailuo動画製品とMiniMax H3が含まれます。

MiniMax H3 / H3 Maxの料金は?

PixExactでは、MiniMax H3 Maxはクレジット課金です。480pは1秒あたり3クレジット、768pは5クレジット、1080pは10クレジット。新規アカウントには無料クレジットが付きます。fal.aiではH3 Maxは秒課金です(falは14 September 2026までのキャンペーン料金を公表し、その後はより高いリスト価格。falのライブ料金を確認してください)。MiniMax M3は別の言語モデルで、そのAPI価格はこの動画モデルの料金ではありません。

MiniMax H3 Maxを無料で使うには?

PixExactは新規ユーザーに無料クレジットを付与し、他の動画モデルと同様にMiniMax H3 Maxへ使えます。fal.aiも自社サンドボックスで1日5回の無料H3 Max生成を案内していますが、それはfalの製品でありPixExactのものではありません。無制限の無料AI動画プランはありません。

PixExactでMiniMax H3 Maxを使うには?

このページを開く(デフォルトモデルはMiniMax H3 Max)、プロンプトを入力し、必要なら開始/終了フレームをアップロード、長さと解像度を設定して生成します。API利用では、falがminimax/h3-max/text-to-videoとminimax/h3-max/image-to-videoを文書化しています。自分のワークフローにH3 Maxを組み込むとは、これらのエンドポイントを呼ぶか、このジェネレーターを使うことであり、ローカルウェイトのインストールではありません。

MiniMax H3 Maxの所要時間とクリップの長さは?

出力は5〜15秒、24 fpsです。fal自身の推論時間(8 September 2026)では、H3 Maxのテキスト→動画は5秒・480pで1秒を大きく下回るところから、15秒・1080pで数十秒まで。5秒の768pジョブは、同社スタック上で3秒未満と挙げられています。PixExactの端から端までの待ちにはキューとアップロードも入るため、実時間はfalの生の推論数字より長くなります。

H3はどの解像度・アスペクト比に対応しますか?

このジェネレーターでは、H3 Maxは480p、768p、1080p、長さは5〜15秒。テキスト→動画のアスペクト比は16:9、9:16、21:9、4:3、1:1、3:4。画像→動画はアップロードしたフレームに従います。ネイティブ2K / フル2KはMiniMax H3(ベース)のワークフローであり、H3 Maxではありません。

1回の生成で参照はいくつ使えますか?

MiniMaxのH3-Base参照モードは画像最大9、動画クリップ3、音声クリップ3、合計12ファイルまで(音声だけでは不可)。falのH3 Max reference-to-videoエンドポイントも同様の12ファイル上限が文書化されています。このPixExactページは現在、テキストと開始/終了の静止画までで、フル参照パックや音声参照には対応していません。

MiniMax H3で既存動画を編集できますか?

MiniMaxは精密な動画編集をH3システムの一部として説明しています。このページはジェネレーターで、プロンプトと静止画から新しいクリップを作ります。手元のフッテージを変えるには、PixExactのAI動画エディターか別の編集ツールを使ってください。ここで生成したあとはファイルをダウンロードし、任意のNLEで編集できます。

MiniMax H3 Maxは商用プロジェクトに使えますか?

fal上のホスト版H3 Maxは、falの利用規約に従う限り商用利用可と文書化されています。PixExact上の生成はPixExactの利用規約に従います。オープンなMiniMax H3ウェイトをセルフホストする場合は、MiniMax H3 Community Licenseを読んでください(MiniMaxは関連リリースで売上上限つきコミュニティライセンスを使っています。製品を出す前にHugging Face上の現行ファイルを確認してください)。

fal.liveとは?このジェネレーターですか?

fal.liveはfalの実験的ライブ配信です。チャンネルはMiniMax H3 Max Directorを走らせ、動画再生中に新しいプロンプトで操縦できるリアルタイムWebRTCセッションです。このページのクリップ生成器ではありません。PixExactは標準のH3 Maxテキスト→動画および画像→動画エンドポイントを使い、完成ファイルを返します。

その他のツール

さらなる AI ツールを探して、クリエイティブな作業を加速しましょう。

MiniMax H3 Maxを実行する準備はできましたか?

プロンプトまたは静止画から開始。ネイティブステレオ音声つきの5〜15秒AI動画を生成し、クリップをダウンロード。新規アカウントには無料クレジットが付きます。