MiniMax H3 は、MiniMax が2026年7月31日に公開したオープンウェイトのマルチモーダル動画モデルです。ネイティブ音声付きで、最大2K・15秒の動画を生成できます。
MiniMax および fal.ai の公開情報に基づく主なポイントです。
テキスト、画像、動画、音声をまとめて生成の文脈として理解します。
映像と同じ処理の中で音声を生成します。
fal では480Pと768Pがネイティブ、2Kと4Kは768Pを高解像度化したものです。
モデルの重みが GitHub などで公開されており、自分の環境で動かせます。
H3 Max は、fal.ai が2026年8月に公開した H3 の追加学習版です。
マルチモーダル参照、fal での7種類のアスペクト比、ローカル実行に対応。
プロンプトへの忠実さ、映像品質、生成速度が最適化されています。
fal の H3 は2K・4K出力に対応。H3 Max は最大1080Pです。
H3 をローカルで動かすには大規模な GPU 環境が必要です。当サイトならクラウドで H3 Max を使えます。