Claudeで使用: チャットから画像と動画を生成
接続

Veo 3プロンプトガイド:GoogleのAI動画をマスター

Google Veo 3の動画生成をプロのプロンプティング技術でマスター。台詞、オーディオ、カメラワーク、スタイルのコツを学ぶ。

ガイド6分で読める

GoogleのVeo 3(VEO 3.1)は、テキストプロンプトからオプションの高品質オーディオ付き4-8秒の動画を生成します。オーディオ機能には台詞、ナレーション、効果音、音楽が含まれており、Veo 3はトーキングキャラクター動画と没入型シーン作成に独自の強みを持ちます。

Veo 3は、MakeInfluencer.aiで利用可能なすべてのAI動画モデルの中で最高のビジュアルフィデリティを誇ります。このガイドでは、自然な台詞の書き方からカメラムーブメントの指示、よくある失敗の回避まで、その能力を最大限に引き出すプロンプティング技術を教えます。

プロフェッショナルなAI動画出力を示すVeo 3プロンプトガイドのヒーロー画像

4-8秒
動画の長さ 1080p 出力解像度 台詞 オーディオ対応 最高 ビジュアルフィデリティ

重要な警告

生成を始める前に、Veo 3の2つの最も重要な制限を理解してください。これにより、クレジットとフラストレーションを節約できます。

有名人・実在人物の検出

Google Veo 3は、キャラクターが実在の人物や有名人に似ていることを検出すると、頻繁に失敗します。インフルエンサーの画像を使用し、Googleのシステムが機密性のあるものまたは実在の人物に似ていると判定した場合、生成に失敗しクレジットは返金されません。インフルエンサーの顔を使ったトーキング動画には、代わりにリップシンク機能をご利用ください。インフルエンサーコンテンツにはより信頼性が高いです。

コンテンツ

Google Veo 3はコンテンツをサポートしていません。プロンプトや画像に成人向けコンテンツが含まれている場合、生成に失敗しクレジットは返金されません。動画にはまたはWAN 2.6 Flashをご利用ください。

Veo 3が得意なこと

AI生成のオリジナルフェイス

実在の人物画像よりもAI生成キャラクターで最も良く機能します。オリジナルのクリエイティブコンテンツに最適。

抽象的・アーティスティックコンテンツ

現実のセレブリティ参照のない、非センシティブなクリエイティブコンテンツに卓越。

テキストから動画生成

入力画像なしでテキスト記述のみから完全なシーンを作成する場合に最強のパフォーマンス。

台詞生成

自然なリップシンク、声、アンビエントオーディオを伴うキャラクタースピーチを1回のパスで生成可能。

最高のビジュアルフィデリティ

2026年のSFWコンテンツにおいて最もフォトリアリスティックなAI動画出力と言えるでしょう。

複数のスタイル対応

フォトリアリスティック、Pixar風、LEGO、アニメ、クレイアニメーション、グラフィックノベルなど多数のビジュアルスタイル。


プロンプト構造

よく作られたVeo 3プロンプトには6つの要素が含まれます。Sora 2と似ていますが、Veo 3を際立たせるユニークなオーディオと台詞機能があります。

オーディオ・ビジュアル要素を示すVeo 3プロンプト構造図

6つの要素

  1. 被写体:シーンに誰または何がいるか -- 詳細な外見の記述
  2. コンテキスト:被写体がいる場所 -- 環境と設定
  3. アクション:何が起きているか -- 動き、ジェスチャー、インタラクション
  4. スタイル:ビジュアルの美学 -- シネマティック、アニメーション、ドキュメンタリー、アーティスティック
  5. カメラモーション:カメラの動き方 -- トラッキング、ドリー、ズーム、パン
  6. オーディオ:台詞、アンビエントサウンド、音楽、効果音

基本的なプロンプトと詳細なプロンプトの比較

基本: A man answers a phone

詳細: A desperate man in a weathered green trench coat picks up a rotary phone mounted on a gritty brick wall, bathed in the eerie glow of a green neon sign. The camera uses a shaky dolly zoom from far away to close-up, revealing tension on his face. Background has neon colors and shadows. Tense ambient music with phone ring and distant rain.

注釈付き例を含むVeo 3プロンプト構造の分解


台詞とスピーチ

Veo 3の最もユニークな機能の一つは、同期したスピーチを持つキャラクターを生成できることです。これは他のほとんどのAI動画モデルとは一線を画します。

台詞の書き方

キャラクタースピーチにはコロンフォーマットを使用します:

Character says: "Your dialogue here"

台詞のベストプラクティス

スピーチは短く

最大8秒の台詞。Veo 3の動画は4-8秒なので、台詞は簡潔でインパクトのあるものにしましょう。

コロンフォーマットを使用

常に'Character says:'の後に引用符付き台詞を使用。他のフォーマットは不安定な結果を生む可能性があります。

不要な字幕を防止

台詞の後に'(no subtitles!)'を追加して、Veo 3が動画にテキストオーバーレイを追加するのを防ぎましょう。

話者を指定

複数キャラクターのシーンでは、誰が話しているか具体的に指定して、生成出力の混乱を避けましょう。

台詞の例

明示的な台詞

A chef in a white apron says: "The secret to perfect pasta is
timing!" (no subtitles!). Kitchen sounds in background with
gentle sizzling and ambient restaurant noise.

暗示的な台詞

A chef explains the secret to perfect pasta cooking (no subtitles!).
Kitchen ambiance with sizzling and clinking of utensils.

台詞 vs リップシンク

AIインフルエンサーのより長いスピーキング動画には、Veo 3の台詞機能ではなくリップシンク機能をご利用ください。リップシンクは最大10分の音声をサポートし、インフルエンサーの顔画像でも確実に動作します。Veo 3の台詞は、短いオリジナルキャラクタークリップに使用してください。


オーディオプロンプティング

Veo 3は各動画でオーディオを生成します。オーディオの指示はビジュアルの指示と同じくらい重要です。

オーディオ要素

  • 台詞:キャラクターが言っていること(コロンフォーマットを使用)
  • アンビエントノイズ:環境音(繁華街、カフェ、海)
  • 効果音:特定の音(電話の着信、足音、グラスの音)
  • 音楽:BGMのスタイルとムード(ソフトジャズ、壮大なオーケストラ)

オーディオの例

Soft jazz music plays with gentle cafe ambiance and espresso machine
Epic orchestral music with medieval sounds and clanking armor
Kitchen sounds, gentle sizzling, knife on cutting board
Birds chirping, soft wind through leaves, distant stream

不要なオーディオの防止

不要なオーディオ要素(スタジオの観客の笑い声など)が出る場合、特定のアンビエントオーディオ記述を追加し、不要な要素を明示的に除外してください。例:"Sounds of distant bands, noisy crowd, ambient background of a busy festival field (no studio audience)."


プロフェッショナルなプロンプト例

トーキングキャラクター動画

カフェの会話

A friendly woman with curly brown hair in a cozy cafe, wearing a
cream sweater, looks directly at the camera with a warm smile.
She says: "Welcome to our little coffee corner! I just made the
most amazing latte art, want to see?" (no subtitles!). Soft jazz
music plays in the background with gentle cafe ambiance.

トラベルVlogセルフィー

A selfie video of a travel vlogger with short blonde hair, wearing
a vintage denim jacket, exploring a bustling Tokyo street market.
She holds the camera at arm's length, her arm visible in frame.
She says: "You have to try this ramen place when you visit Tokyo -
it's been family-owned for 50 years!" (no subtitles!). Background
sounds of busy market and distant chatter.

料理チュートリアル

A chef with a white apron and friendly smile in a modern kitchen,
hands moving expressively as he explains. He says: "The secret to
perfect pasta is timing - al dente means it should have just a
tiny bite to it" (no subtitles!). Kitchen sounds, gentle sizzling.

アーティスティックスタイル動画

Pixarアニメーション

In the style of Pixar animation: A cheerful robot with big
expressive eyes discovers a small flower growing through concrete
in a futuristic city. The robot gently touches the flower with
wonder. Soft orchestral music plays with gentle wind sounds.

LEGOスタイル

In the style of LEGO: A LEGO minifigure knight stands heroically
on a castle wall at sunset, wind blowing through a LEGO flag.
Epic cinematic music with medieval ambiance sounds.

アニメスタイル

In the style of anime: A young warrior with silver hair stands
on a mountain peak, cape flowing in the wind, overlooking a vast
fantasy landscape with floating islands. Dramatic orchestral
music with wind sounds.

セルフィースタイル動画

異なる出力間のVeo 3解像度と品質比較

Veo 3は、本物のように見えるセルフィー動画の作成に優れています。これらは、視聴者がパーソナルで直接カメラに向かったコンテンツを期待するSNSプラットフォームで特に優れたパフォーマンスを発揮します。

セルフィー動画のフォーミュラ

  1. "A selfie video of..." で始める
  2. 腕を見えるようにする:"holds the camera at arm's length, arm visible in frame"
  3. 自然な目の動きを含める:"occasionally looking into the camera"
  4. 本物らしいテクスチャーを追加:"The image is slightly grainy, looks film-like"
  5. キャラクターがいる環境を記述
  6. 自然なアンビエントオーディオを追加

このフォーマットは本物らしくパーソナルに感じられるコンテンツを作成し、SNSコンテンツ制作バズる方法に最適です。


カメラテクニック

Veo 3は標準的な映画撮影用語によく反応します。プロンプトにカメラの指示を含めると、出力の品質とプロフェッショナリズムが大幅に向上します。

ムーブメントタイプ

ドリーショット

A slow dolly shot moves through a misty forest at dawn, revealing
ancient trees covered in moss. Gentle nature sounds, birds
chirping, soft wind through leaves.

ズームアウトリビール

A dramatic zoom out from a close-up of a dewdrop on a flower
petal to reveal a vast meadow filled with wildflowers under
morning sunlight. Peaceful nature ambiance.

カメラ用語リファレンス

プロンプトで特定のカメラワークに使用する用語:

  • アイレベル:標準的な視点、自然で共感しやすい
  • ハイアングル:見下ろす -- 脆弱性や俯瞰を表現
  • ローアングル:見上げる -- ドラマと力強さを演出
  • ドリーショット:カメラがトラック上で前後に移動
  • トラッキングショット:カメラが被写体を横方向に追従
  • パンショット:カメラが固定点で水平に回転
  • ズームイン/アウト:カメラは固定で焦点距離が変化

スタイルのバリエーション

ビジュアル例を含むVeo 3ベストプラクティスまとめ

Veo 3は幅広いアーティスティックスタイルをサポートしています。一貫した結果を得るために、プロンプトの先頭にスタイル宣言を付けてください。

利用可能なスタイル

アニメーションスタイル

Pixar、クレイアニメーション、South Park、LEGO、Simpsons -- それぞれ独特のビジュアル特性を持つ。

アーティスティックスタイル

グラフィックノベル、折り紙、大理石彫刻、設計図、8ビットレトロ -- クリエイティブな表現向け。

シネマティックスタイル

フォトリアリスティック、ドキュメンタリー、ヴィンテージフィルム、ノワール -- プロフェッショナルな動画コンテンツ向け。


よくある問題の回避

字幕の防止

不要なテキストオーバーレイはVeo 3で最もよくある問題の一つです。以下のルールに従ってください:

  • 台詞を使用する際は常にプロンプトに"(no subtitles!)"を追加
  • 台詞にはコロンフォーマットを使用:says: "text"
  • 引用符のみのフォーマットを避ける:says "text"(字幕がトリガーされやすい)
  • それでも字幕が表示される場合は、末尾に"No subtitles. No subtitles!"を追加

キャラクターの一貫性

複数の生成でビジュアルの一貫性を維持するために、キャラクター記述を同一に保ちます:

Sarah, a woman in her early 30s with shoulder-length auburn hair,
warm brown eyes, wearing a cream linen blouse and gold necklace,
with a friendly and confident expression

このキャラクターを使用するすべてのプロンプトでこの正確な記述を繰り返してください。画像と動画全体で最大のキャラクター一貫性を実現するには、MakeInfluencer.aiのトレーニング済みLoRAモデルを使用してください。


Veo 3と他の動画モデルの比較

完全な比較については、2026年版ベストAI動画ジェネレーターガイドをご覧ください。

Feature
Veo 3
Sora 2
ビジュアルフィデリティ
最高クラス
高い
台詞サポート
自然なスピーチ生成
限定的
オーディオ品質
オプション付きで含まれる
デフォルトで含まれる
コンテンツの柔軟性
中程度
厳格
コスト
8,000クレジット/秒(オーディオなし)
40,000+クレジット/動画
最適な用途
リアリスティックと台詞コンテンツ
シネマティック クリエイティブコンテンツ

Veo 3を選ぶべき場合:最高のビジュアルフィデリティ、台詞主導のコンテンツ、フォトリアリスティックな出力の場合。Sora 2を選ぶべき場合:シネマティックでアーティスティックな構図とクリエイティブストーリーテリングの場合。Kling v3.0を選ぶべき場合:コスト効率の良い日常コンテンツとモーションコントロールダンス動画の場合。


プロのコツまとめ

常に(no subtitles!)を追加

台詞を含むすべてのプロンプトにこれを含め、動画への不要なテキストオーバーレイを防止。

スピーチにはコロンフォーマット

Character says: 'Hello' -- このフォーマットが最も信頼性の高い台詞生成結果を生みます。

オーディオを詳細に記述

アンビエントサウンド、音楽スタイル、効果音を指定。曖昧なオーディオプロンプトは一般的な結果を生みます。

一貫したキャラクター記述

同じキャラクターのすべてのプロンプトで同一の外見記述を使用し、ビジュアルの連続性を維持。

カメラの指示を含める

カメラムーブメント、アングル、フレーミングを指定して、一般的なAI動画を超えるプロフェッショナルな出力を。

スタイルを先に宣言

プロンプトの先頭に'In the style of...'を付け、動画全体で一貫した美的処理を。


よくある質問

AIインフルエンサーの画像でVeo 3を使用できますか?

注意が必要です。Veo 3は実在の人物に似た画像を頻繁に拒否します。AIインフルエンサーの顔を使った信頼性の高いトーキング動画には、代わりにリップシンク機能をご利用ください。Veo 3はオリジナルキャラクターコンテンツ、エスタブリッシングショット、特定の顔を必要としないクリエイティブシーンに使用してください。

Veo 3の生成が失敗したのはなぜですか?

最も一般的な原因は、入力画像が実在の人物に似ていた(代わりにAI生成の顔を使用してください)、プロンプトに著作権のある参照が含まれていた、またはコンテンツがとしてフラグ付けされた場合です。生成に失敗してもクレジットは返金されないため、生成前にコンテンツポリシーを確認してください。

SNSに最適な動画の長さはどれくらいですか?

Veo 3は4-8秒の動画を生成します。TikTokとReelsには、フック、トランジション、スタンドアロンクリップに最適です。より長いコンテンツには、複数のVeo 3クリップをエディターで結合するか、最大10分のトーキングヘッド動画にはリップシンクをご利用ください。

最高の台詞品質を得るにはどうすればよいですか?

台詞は8秒以内にしてください。コロンフォーマット("Character says:")を使用してください。テキストオーバーレイを防止するために"(no subtitles!)"を追加してください。キャラクターの話し方を記述してください(「warm and enthusiastic」vs「calm and measured」)。台詞をリアルな環境に根付かせるためにアンビエントオーディオを含めてください。

Veo 3をMakeInfluencer.aiの他の機能と組み合わせられますか?

はい。Veo 3をシネマティックなエスタブリッシングショットとBロールに使用し、モーションコントロールダンス動画とリップシンクトーキングヘッドを組み合わせて完全なコンテンツパッケージを作成できます。AI画像生成を使用して、動画パイプラインに入力するキャラクター画像を作成してください。

Veo 3の価格はどうなっていますか?

Veo 3はオーディオなしで1秒あたり8,000クレジット、オーディオありで1秒あたり12,000クレジットです。オーディオ付きの一般的な8秒動画は96,000クレジットです。よりコスト意識の高いワークフローには、1秒あたり4,000クレジットのKling v3.0 Standardと比較してください。


Veo 3で作成を始めましょう

Veo 3は2026年に利用可能な最も視覚的に印象的なAI動画モデルです。プロンプティング技術をマスターすれば、コストのほんの一部でプロフェッショナルな映像制作に匹敵するコンテンツを制作できます。

1

MakeInfluencer.aiに登録

アカウントを作成し、プランを選択して、すぐにVeo 3動画の生成を開始できます。

2

テキストから動画で始める

モデルを学びながら有名人検出の問題を避けるため、T2Vプロンプト(入力画像なし)から始めましょう。

3

6つの要素を練習

最良の結果を得るために、すべてのプロンプトに被写体、コンテキスト、アクション、スタイル、カメラモーション、オーディオを含めましょう。

4

台詞を試す

(no subtitles!)付きのコロン台詞フォーマットを試して、トーキングキャラクタークリップを作成しましょう。

5

コンテンツパイプラインを構築

Veo 3のシネマティッククリップとモーションコントロールおよびリップシンクを組み合わせて、完全なAI動画ワークフローを構築しましょう。

MakeInfluencer.aiでVeo 3による作成を始める

自分で試してみる準備はできましたか?

AIインフルエンサーの作成とコンテンツ生成を数分で始められます。