Veo 3.1 について
Veo 3.1 は Google DeepMind のフラッグシップ動画生成モデルです。文章で書いたシーン描写を映画のようなショートクリップに変換し、多くの動画モデルと異なり、台詞・環境音・効果音といったネイティブ音声を映像と同期させて一度に生成します。
際立った強みは演出コントロールです。Veo は映画の言語を理解します:ショットの種類、レンズ選択、ドリーインやクレーンショットなどのカメラワーク、ライティング、ムード。脚本の香盤表のように書かれたプロンプトは、緩い描写より安定して良い結果を出します。
だからこそ、Veo ではプロンプトの質が他のモデル以上に重要です。下のギャラリーには検証済みの Veo プロンプトと実際の出力を収録しています。ゼロから試行錯誤する代わりに、動く構造をそのままコピーできます。
Veo 3.1 プロンプトの書き方
- 1ショットブリーフの構造で書く:被写体 → 動き → 場面 → カメラ → 光 → ムード。Veo は形容詞の羅列より映画用語に反応します。
- 2カメラワークを明示する——「ゆっくりドリーイン」「手持ちのトラッキングショット」「空撮クレーンダウン」。1 クリップにつきカメラ指示は 1 つに絞ると動きが一貫します。
- 3音も演出する:台詞は引用符に入れ、環境音を描写する(「トタン屋根を打つ雨、遠くの雷鳴」)。音声指示がないと平凡なアンビエンスになりがちです。
- 4光とカラーグレードで画の質感を固定する:「ゴールデンアワーの逆光、浅い被写界深度、ティール&オレンジのフィルムグレード」。
- 51 プロンプトにつき 1 シーン。Veo は単一の連続ショットが得意で、複数カットを詰め込むと動きが断片化します。
- 6一度に変えるのは 1 変数だけ——カメラ、光、動きのいずれか。どのフレーズが結果を動かしたか判別できます。
よくある質問
Veo 3.1 は何が得意ですか?
リアルな動きと同期したネイティブ音声を備えたシネマティックなワンショットクリップです。意図あるカメラワーク、一貫したライティング、シーンに合った音——「演出された」映像が必要なときの最有力です。
良い Veo 3.1 プロンプトの書き方は?
タグ付けではなく監督のように書きます。1 つのシーンを自然な文章で描写し、カメラ・光・音の指示を明示します。このページの検証済みプロンプトをコピーして被写体を差し替えるのが、ゼロから書くより速い出発点です。
Veo 3.1 は音声や台詞も生成できますか?
はい——ネイティブ音声こそ Veo の看板機能です。映像と同期した音声・環境音・効果音を生成します。台詞は引用符に入れ、音場を具体的に描写すると最良の結果が得られます。
これらの Veo プロンプトはどこで試せますか?
Veo は Google の Gemini アプリと Flow で利用でき、開発者は Gemini API から使えます。このページのプロンプトをコピーして貼り付け、被写体やカメラ表現を自分のシーンに合わせて調整してください。
関連モデル
Nano Banana Pro
Google's Gemini image flagship with 4K output, Thinking mode and search grounding for reference-accurate results.
Nano Banana
Google's fast, free conversational image generation and editing model.
Imagen 4
Google's photorealism flagship — the model to reach for when the image itself is the product.
MiniMax H3
MiniMax H3 is a powerful multimodal video generation model that creates up to 15-second 2K videos with native stereo sound from text, image, video, and audio inputs.