MiniMax H3 プロンプト
MiniMax のマルチモーダル動画モデル——テキスト、画像、クリップ、サウンドトラックのどれからでも、ネイティブステレオ音声付きの動画を生成。
MiniMax H3 について
MiniMax H3 は MiniMax の Hailuo 動画シリーズのフラッグシップです。最大の特徴は、入力が真にマルチモーダルで、出力が一発で完結すること。テキスト描写、参照画像、既存の動画クリップ、音声トラック、あるいはその組み合わせから生成を始められ、結果には映像と同時に生成されるネイティブステレオ音声が付いてきます。後付けのアフレコではありません。
この組み合わせが活きるのは「完成品らしさ」が求められる場面です。環境音が商品を売る広告クリップ、足音や室内音が空気感を支える物語シーン、静止画に説得力ある動きと音を与えて生き返らせる image-to-video。Hailuo シリーズで知られる物理的リアリズムを受け継ぎ、ドリー・オービット・ハンドヘルドといったカメラ指示への追従性も際立って高いモデルです。
Hailuo 02 を使ったことがあれば H3 は馴染みやすい一方、曖昧さへの寛容さは大きく減っています。旧世代は短い場面描写を渡せば残りを埋めてくれました。H3 は被写体・動作・場面・カメラ・光・音、そして入力モダリティ自体という 6〜7 本の独立したレバーを差し出し、引かなかったレバーはそれぞれの既定値のまま返してきます。制御性が高いことは、実際に使い切ってはじめて利点になります。
実務上の違いはこうです——MiniMax H3 のプロンプトはキャプションではなく香盤表に近い。「雨の中を歩く女性、シネマティック」では、そつはないが顔のないクリップが返ってきます。レンズ、歩く方向、彼女に対するカメラの動き、光の質、雨が何の素材に当たってどう鳴るかまで書けば、実際に編集で使えるショットが返ってきます。
H3 は受け付ける入力が多いぶん、「今回何をするか」を伝えるのはプロンプトだけです——曖昧に書くほど、強みである制御性を捨てることになります。上のギャラリーには検証済みの MiniMax H3 プロンプトと実際の生成動画を収録しています。動く構造をコピーして、被写体・動き・音風景を自分のものに差し替えてください。
このページのプロンプトはすべて無料でコピーできます。登録も課金の壁もなく、プロンプト本文に透かしもありません。構造だけ持ち帰り、名詞を差し替えて、モデルが使える環境で実行してください。
MiniMax H3 プロンプトの書き方
- 1構造は「被写体 → 動作 → 場面 → カメラ → 光とムード → 音」。H3 は 6 層すべてを読みます。書かなかった層は、モデルが勝手に決めます。
- 2キャプションではなくショットとして書く。「シネマティック」「高品質」は最も無駄な 2 語です——本当に言いたい具体物、つまりレンズ、カラーグレード、時刻、天候に置き換えてください。
- 3本物のカメラ用語を使う:「ゆっくりとドリーイン」「ハンドヘルドの追跡ショット」「被写体の周りをオービット」。名前のあるカメラワークへの追従精度は、「ダイナミックなショット」のような曖昧な表現とは段違いです。
- 4スローモーションは被写体ではなく映像の属性として書く:「スローモーションで撮影、水滴が空中に留まる」は効き、「彼女はゆっくり動く」は等速でのろのろ歩くだけです。途中で速度を変えたいなら、変わる瞬間を明記します——「等速、グラスが床に当たる瞬間からスローモーションへ」。
- 5音は明示的に演出する——音声はネイティブ生成なので、指示がちゃんと届きます:「トタン屋根を打つ雨、遠雷、音楽なし」「ナレーションの下でアップビートなシンセが盛り上がる」。何も書かなければ、汎用的な環境音になります。
- 6音そのものより素材を書く。「足音」では漠然としていますが、「濡れた砂利を踏むブーツ」なら合成する材料が渡ります。「雨」でも「エンジン」でも同じ手が効きます。
- 7無音が欲しいなら、無音と書く——「音楽なし、台詞なし、室内のアンビエンスのみ」。静けさも H3 が従う指示ですが、出さなければ従いようがありません。
- 8参照画像から始めるときは、動きとカメラだけを書く——被写体・スタイル・構図は画像がすでに決めており、二重に描写するとブレの原因になります。
- 91 回の生成にはアクションの節目を 1 つだけ。1 クリップに 3 つの物語の瞬間を詰め込むと全部がぼやけます。長い物語は生成を分けて編集でつなぐこと。
- 10ルックは再利用可能な一句に固定する——フィルムの質感、カラーグレード、レンズの個性——キャンペーン全体で一字も変えなければ、どのクリップも違和感なくつながります。
- 11ショットをまたいで同一人物を保つには、人物を文章で描写し直すのではなく、同じ参照画像を毎回の生成に渡します。顔の文章描写は生成ごとにブレますが、画像はブレません。
- 12外した結果が出たら、プロンプト全体を書き直すのではなく 1 層だけ変えて再生成する。全部書き直すと、どの一句が効いたのか永遠に分からなくなります。
よくある質問
MiniMax H3 のプロンプトはどう書けばいいですか?
香盤表の順で書きます:被写体、動作、場面、カメラワーク、光とムード、音。H3 はこの各層を別々の指示として読むので、空けた層はモデルが既定値で埋めます。1 回の生成につき連続したアクションは 1 つ、カメラワークは実在の撮影用語で、音は必ず明記。上のギャラリーのプロンプトはすべてこの形です——一つコピーして被写体を差し替えるのが最短の習得法です。
MiniMax H3 は無料で使えますか?
このページのプロンプトは無料です——アカウント不要、課金の壁なしでコピーできます。モデル自体は MiniMax の Hailuo AI アプリと MiniMax オープンプラットフォーム API 経由で、料金や無料枠の条件は MiniMax 側で決まるため、現時点の条件は先方のページでご確認ください。
MiniMax H3 は何が得意ですか?
「完成品として届く」クリップです。映像とステレオ音声を同時に生成し、入力はテキスト・静止画・既存クリップ・音声トラックのどれでも構いません。物理的リアリズムと正確なカメラ追従により、広告、シネマティックなワンカット、image-to-video に特に強い選択肢です。
MiniMax H3 は音も生成しますか?
はい——ステレオ音声は映像とともにネイティブに生成され、後付けではありません。プロンプトでミックスを演出するほど真価を発揮します:環境音、効果音、音楽の有無を明記してください。指示がなければ汎用的な環境音になります。
MiniMax H3 でスローモーションを出すには?
スローモーションは被写体の性質ではなく、映像の性質として指定します。「スローモーションで撮影」「ハイスピードカメラ撮影、スロー再生」はクリップの撮られ方を変えますが、「彼女はゆっくり動く」は等速で鈍く動くだけです。スローでしか見えないディテール——飛沫、粉塵、布、髪——を添えて効果に見せ場を与え、途中で速度を変えるならその瞬間を明記してください。
テキストの代わりに画像や音声から始められますか?
できます。H3 の入力はマルチモーダルです。参照画像で被写体と構図を決め、既存クリップを延長・リスタイルし、音声トラックでシーンを駆動できます。画像がルックを担っている場合、テキストは動きとカメラだけに絞りましょう。
MiniMax H3 と Hailuo 02 は何が違いますか?
同じ Hailuo 動画シリーズの 2 世代です。Hailuo 02 は短い場面描写を渡せば判断の多くを代わりに済ませてくれます。H3 は入力がマルチモーダルで、ステレオ音声を映像と同時にネイティブ生成し、それらの判断の多くを制御項目として手元に返します——つまり、細かく書いたプロンプトに報い、手を抜いたプロンプトには旧世代より厳しいということです。
MiniMax H3 がプロンプトの一部を無視するのはなぜ?
たいていは 1 つのプロンプトで複数のことを同時に頼んでいるからです。H3 は連続したアクションの節目 1 つならうまく扱いますが、3 つの物語の瞬間を含むプロンプトは平均化されてぼやけます。もう一つの典型は、参照画像がすでに決めたことを文章で描写し直すこと——画像と文章が食い違えば結果はブレます。1 つの節目まで削り、1 層ずつ変えて再生成してください。
これらの MiniMax H3 プロンプトはどこで試せますか?
H3 は MiniMax の Hailuo AI アプリで利用でき、開発者は MiniMax オープンプラットフォームの API から使えます。このページのプロンプトをコピーして貼り付け、被写体・カメラワーク・音風景を自分のものに置き換えてください。
関連モデル
Hailuo 02
MiniMax's Hailuo video model with standout physical realism.
Speech 2.5
MiniMax's multilingual voice synthesis model.
Seedance 2.0
ByteDance's #1-ranked video model — multi-shot direction with native lip-sync and spatial audio.
Seedance 2.5
Seedance 2.5 is a next-gen AI video model that generates continuous, synchronized 30-second 4K clips from a single prompt.