MiniMax H3 テキスト動画生成 API
被写体、カメラワーク、テンポ、構図、映像スタイル、会話、音声の意図を含む文章の指示から、完成した動画シーンを生成します。
下のインタラクティブなMiniMax H3デモを直接利用できます。参照素材と明確なプロンプトを追加し、アカウントを作らずにキャラクターの一貫性、モーション転写、ビジュアルスタイル、同期音声を体験してください。
この生成ツールは第三者のHugging Face Spaceから埋め込まれています。アップロードファイルの扱いと生成機能の提供状況は同Spaceの規約に従い、稼働中の待機列によって変動する場合があります。
無料 MiniMax H3とマルチモーダル動画生成に関連する最新AIエージェントを発見。登録不要で使える動画、音声、画像、クリエイティブ自動化ツールを実用的に比較できます。
無料 MiniMax H3と、テキスト・画像・参照素材から動画を作る関連AIツールを体験。ネイティブ音声付きマルチモーダル動画を、登録もクレジットカードも不要で無料生成できます。
gpt image 2 に役立つ無料AIツールを見つけましょう。画像生成、ビジュアル編集、実用的なAIワークフローをオンラインで試せます。登録不要、クレジットカード不要です。
テキストから高品質なAI画像を無料でオンライン生成。登録不要、クレジットカード不要、回数無制限で、広告、ポスター、商品画像、サムネイル、SNS素材に使えます。
参考画像をアップロードしてAIで無料変換・編集。登録不要、クレジットカード不要、回数無制限で、スタイル変更、画像バリエーション、商品ビジュアル、写真補正に便利です。
Nano Banana AI に役立つ無料AIツールを見つけましょう。画像生成、ビジュアル編集、実用的なAIワークフローをオンラインで試せます。登録不要、クレジットカード不要です。
Flux AI画像生成ツール に役立つ無料AIツールを見つけましょう。画像生成、ビジュアル編集、実用的なAIワークフローをオンラインで試せます。登録不要、クレジットカード不要です。
無料AI写真エディターでポートレート、商品画像、背景、SNSグラフィックをオンライン編集。登録不要、クレジットカード不要で、クリエイティブな編集を回数無制限で試せます。
無料AI画像変更ツールと画像エディターで、オブジェクト、人物、服装、背景、色、広告シーンを編集。登録不要、クレジットカード不要で、回数無制限に変更できます。
MiniMax H3でマルチモーダルAI動画を無料作成。テキスト、画像、参照素材からネイティブステレオ音声付き動画を登録不要で生成し、オープンソースプロジェクトにも直接アクセスできます。
無料の試用からアプリケーション向けワークフローへ移行するなら、専用のMiniMax H3 APIを利用できます。入力形式に合うエンドポイントを選び、動画生成を製品、エージェント、キャンペーン、自動メディアパイプラインに接続できます。
被写体、カメラワーク、テンポ、構図、映像スタイル、会話、音声の意図を含む文章の指示から、完成した動画シーンを生成します。
元画像を動かしたり、開始・終了フレームを指定したりしながら、視覚的な特徴、レイアウト、商品、キャラクター、制作意図を維持します。
画像、動画、音声の複合参照を使い、外観、動き、リズム、音、スタイルを新しいマルチモーダル動画へ転写します。
MiniMax-H3 GitHubリポジトリで公開された再現可能な例をご覧ください。3本の動画は、H3-Baseがテキストプロンプト、画像ガイド、複合参照入力を扱い、映像と音声を同期生成する様子を示します。
文章プロンプトでシーン、動作、カメラ表現、タイミング、音を制御し、ひとつの視聴覚シーケンスとして設計された動画を生成します。
元画像または開始・終了フレームで構図を固定しながら、MiniMax H3が動き、遷移、付随する音声を生成します。
映像と音声の複合参照によって、人物や物の特徴、動き、スタイル、リズム、音を導き、より制御性の高いマルチモーダル生成を実現します。
MiniMax H3は映像理解、モーション生成、ネイティブ音声をひとつの動画モデルに統合します。制作に役立つ機能を確認し、無料デモ、オープンソースH3-Base、またはプロジェクトに合うAPIを選べます。
テキスト・画像・動画・音声を参照
テキストだけでなく、自然言語プロンプトとマルチモーダル参照で生成を指示できます。H3は外観、動き、スタイル、タイミング、音の手掛かりをまとめて解釈します。
ネイティブ32 kHzステレオ音声
会話、環境音、効果音、音楽の意図を含む映像と音声を、別工程ではなく一貫したひとつの結果として生成します。
4~15秒の動画生成
横長、正方形、縦長、超横長の各アスペクト比で、4~15秒、24 FPSの短編動画を作成。SNS、広告、商品紹介、物語制作に対応します。
正確な動きとプロンプト追従
詳細な指示と参照素材によるモーション転写で、動作、カメラ移動、遷移、場面転換、物体の挙動、構図を制御できます。
読みやすい文字とブランドを意識した映像
文字表現と視覚的アイデンティティの一貫性が求められる広告、UI案、パッケージ、タイトルカード、ECコンテンツ、ブランドシーンを制作できます。
オープンソースのH3-Baseチェックポイント
FL2VAとRef2VAのH3-Baseチェックポイントをダウンロードし、SGLang、vLLM、Diffusers、ComfyUIなどの対応ランタイムへ接続して独自環境に導入できます。
単純な動き以上の表現が必要な動画にMiniMax H3を活用できます。マルチモーダル制御により、商用、創作、教育、エンターテインメントの各用途で、視覚的特徴、音、タイミング、演出を繰り返し再現できます。
キャンペーン案、商品画像、ブランド参照、音声指示から、構図、文字、遷移、雰囲気を制御した短いプロモーション動画を作成します。
商品写真に動きを付け、素材感や動作を見せるほか、既存素材からローンチ予告や洗練されたストア向け映像を作れます。
参照素材で一貫性を保ちながら、キャラクター、会話、カメラ移動、環境、同期音声を含む短い物語シーンを作成します。
本制作前に、カットシーン、協力ゲームのイントロ、キャラクターアニメーション、UI演出、世界観のアイデアを試作できます。
構成案、図表、イラストスタイル、ナレーション付き概念を、視覚的な説明とネイティブ音声を組み合わせた簡潔な教育動画へ変換します。
縦長、正方形、横長のコンテンツを、SNSフィード、音楽プロモーション、クリエイターチャンネル、複数案の迅速なキャンペーン検証向けに制作します。
MiniMaxはローカル環境やプライベート基盤向けに、H3-BaseのモデルコードとBF16形式のFL2VA・Ref2VAチェックポイントを公開しています。公式リポジトリを確認し、適切なマルチGPU環境を用意して、生成モードに合う推論フレームワークを選択してください。
基盤を用意する前に、ライセンス、インストール要件、モデルの種類、対応ランタイム、最新の公式手順を確認します。
Hugging Face CLIでmodel_index.jsonと、テキスト・フレーム指定または複合参照生成向けのBF16 H3-Baseチェックポイントを取得します。
SGLangまたはvLLMで導入するか、利用可能なDiffusers、ComfyUI連携を使います。公式SGLang例はテンソル並列のマルチGPU構成です。
推論サービスの周囲にアップロード検証、ジョブキュー、ストレージ、モデレーション、進捗表示、配信を実装します。基盤運用が現実的でない場合はホスト型APIを利用できます。

git clone https://github.com/MiniMax-AI/MiniMax-H3.git
cd MiniMax-H3
hf download MiniMaxAI/MiniMax-H3 \
--include "model_index.json" "FL2VA/*" "Ref2VA/*" \
--local-dir MiniMax-H3オープンソースの範囲: H3-Baseチェックポイントは公開済みです。ホスト版のContext-IR前処理モデルとRegenerate-2Kモジュールは現時点でオープンソース版に含まれないため、ローカル結果と完全なホスト版パイプラインは同一ではありません。
公式導入ガイドを読む埋め込みの参照動画デモから始め、動き、被写体、スタイル、音声の方向性がイメージに合うまでプロンプトと参照素材を調整します。
参照素材を追加
具体的な動画プロンプトを作成
生成・確認・調整