MiniMax H3はテキスト・画像・動画・音声をひとつの文脈として読み取ります。ここにあるMiniMaxプロンプトは、その全部をまとめて指示する書き方を示しています:時間ごとのビート、音、カメラワーク、そして動かしたくない部分の固定。
ここのMiniMaxプロンプトは一文の説明ではなく、撮影指示書に近い形です。効き方が大きいのは次の6つ。
ファイルをただ添付するのではなく、役割を指定します。「画像1がロケーション、画像2が主役、音声1が彼女の声」。MiniMax H3は混在する入力をひとつの文脈として扱うので、各素材が何を担うかを書くことで、素材の束が演出指示に変わります。
クリップをタイムラインとして書きます:「0〜5秒で棚沿いを歩く、5〜10秒でボトルを光にかざす、10〜15秒で元に戻す」。ビートを書いてはじめてショットの順番が決まり、平均化された一つの動きになりません。
「何を撮るか」だけでなく「どう撮るか」を書きます。16mmの粒子感、抑えた色数、硬めのトップライト、手持ちの微かな揺れ、少し遅れるオートフォーカス。撮った映像に見えるか、レンダリングに見えるかを分けるのはこの部分です。
MiniMax H3は映像と同じ一度の生成でステレオ音声まで作るので、音は受け取るものではなく演出できるものです。楽器を指定し、具体的な効果音を指定し、どの秒で鳴るかを書き、どこを無音にするかも書きます。「音楽を少し」だけでは、この強みを捨てることになります。
変えない部分と出したくない部分を言い切ります:衣装はそのまま、字幕なし、ウォーターマークなし、ゆるいディゾルブなし。固定要素を書いておくことが、キャラクターの顔や商品のディテールがクリップの途中で崩れるのを防ぎます。
寄る、引く、左に振る、上にあおる、追いかける。1ビートに1つの明確な動きを書くほうが、3つを一文に詰め込むより確実に決まり、被写体も置いた位置に留まります。
入力が一種類のモデル向けの書き方だと、MiniMax H3の大半は使われないまま終わります。差が出やすいのはこの4つ。
オムニモーダルの意味はここにあります。「動画1のカメラワークを借りて、画像2のキャラクターを入れ、話し方は音声1に合わせる」——この一文がそのままプロンプトになります。他のモデルでは入力を一種類だけ選び、あとは運任せになりがちです。
音声用の工程が別にない分、キャラクターの台詞、その下に流れる部屋の空気音、タイトルに当たる一発の音楽まで、すべてプロンプトの本文です。ここを省いたMiniMaxプロンプトには、モデル既定の当たり障りのない環境音が付いてきます。
指示ベースの編集は名指しした一箇所だけを変え、決まっているライティング・構図・演技はそのまま残します。「背景を夜の街に差し替え、他はそのまま」のほうが、気に入っているショットを丸ごと再生成するより得です。
MiniMax H3は詳しい指示書を受け止め、細部も保ちます。短さが美点になるモデルもありますが、ここでは具体的で構造のある版こそが、最後の書き出しまで残る版です。
MiniMaxプロンプトは6種類、それぞれ重心が違います。撮りたいショットに一番近いところから始めてください。
元になるフレームがないので、構図の全部をプロンプトが背負います:被写体・動き・場所・光・カメラ。脚本のように詰め込むより、1シーンに主要な動きを1つのほうがうまくいきます。
最初か最後のフレームを渡した時点で、見た目と構図は決まっています。この画像から動画のプロンプトは、動き・フレーム間のつなぎ・そのまま留めておくものに文字数を使うべきです。
静止画・クリップ・音声を混ぜ、それぞれの役割を書きます:見た目はこれ、動きのリズムはこれ、声はこれ。効くプロンプトは、ファイル任せにせず特徴を言葉でもう一度書いています。
一度の生成に複数のショットを入れ、時間で区切り、つなぎ方も指定します——ハードカット、ホイップパン、形を合わせたマッチカットなど。指定しないと、編集は締まりのない滑らかさに流れます。
キャラクター主導のクリップでは、台詞・言い方・間の取り方までプロンプトに書きます。声の参照と言葉での特徴指定を重ねると、複数のショットで同じ人物として保てます。
被写体の入れ替え、背景の差し替え、昼から夜へのライティング変更、台詞の言い換え。直す箇所と触らせない箇所を一緒に書く方法を、この種のプロンプトが示しています。
MiniMax H3はMiniMaxの最新の動画モデルです。MiniMaxプロンプトが他と違うのは、このモデルがテキスト・画像・動画・音声をひとつの文脈として読み取り、映像と同じ一度の生成でステレオ音声まで作るところ。ひとつのプロンプトでカメラ・演技・セリフ・音をまとめて指示でき、そのあと一箇所だけを他に触らず差し替えられます。このコレクションではプロンプトを全文そのまま掲載しているので、どの書き方が効いたのかを推測せずに確かめられます。新しいMiniMax H3の実例が出てきたら追加していきます。
MiniMaxプロンプトをコピーして、Hailuo AIで使うか、MiniMax H3を提供しているAPIプロバイダー経由で利用できます。プロンプト自体は特定サービス専用のパラメータ構文ではなく、構造化された普通の文章なので、このモデルが使える場所ならそのまま持ち込めます。
画像モデル向けに書くよりは長めです。MiniMax H3は細部を保つので、素材の役割・時間配分・音まで書いた指示書のほうが、うまい一文よりたいてい効きます。ただし長さ自体が目的ではありません。形容詞を積んでも意味はなく、逆に音声トラックや固定要素を書き忘れると、その判断をモデルに委ねることになります。
できますし、出発点としては悪くありません。どのモデルも専用のパラメータ構文を必要としないからです。ただ流用したプロンプトには、音の指示と素材の役割分担が抜けているのが普通です——元のモデルがどちらも扱えなかったからです。欲しい音を足し、各素材に役割を書き、固定要素を明示すれば十分です。
使えます。むしろこのモデルが得意なほうの使い方です。指示ベースの編集は名指しした部分だけを変えます——物を差し替える、背景を替える、ライティングを変える、台詞を言い換える——一方で決まっている構図・光・演技はそのまま残ります。コレクション内の編集用プロンプトは、直す箇所と触らせない箇所を一緒に書く方法を示しています。
完全無料で閲覧・コピーでき、登録も不要です。MiniMax H3で実際に生成する場合は、Hailuo AIか、このモデルを提供しているプロバイダー側で行うことになります。

































