Claude에서 사용: 채팅에서 이미지와 영상 생성
연결하기

Veo 3 프롬프트 가이드

Google Veo 3 영상 생성을 전문적인 프롬프트 기법으로 마스터하세요. 대화, 오디오, 카메라 워크, 스타일 팁을 배워보세요.

가이드11분 소요

Google의 Veo 3(VEO 3.1)는 텍스트 프롬프트로 4-8초 영상을 선택적 고품질 오디오와 함께 생성합니다. 오디오 기능에는 대화, 보이스오버, 효과음, 음악이 포함되어 있어, 토킹 캐릭터 영상과 몰입감 있는 장면 제작에 독보적인 강점을 보입니다.

Veo 3는 MakeInfluencer.ai에서 이용 가능한 AI 영상 모델 중 가장 높은 시각 품질을 제공합니다. 이 가이드에서는 자연스러운 대화 작성부터 카메라 연출, 흔한 실수 방지까지 Veo 3의 잠재력을 최대한 끌어내는 프롬프트 기법을 알려드립니다.

Veo 3 프롬프트 가이드 히어로 이미지 - 전문적인 AI 영상 출력

4-8초
영상 길이 1080p 출력 해상도 대화 오디오 지원 최고 시각 품질

중요 경고

생성을 시작하기 전에 Veo 3의 가장 중요한 두 가지 제한 사항을 이해하세요. 크레딧과 시간을 절약할 수 있습니다.

유명인 및 실제 인물 감지

Google Veo 3는 캐릭터가 실제 인물이나 유명인을 닮았다고 감지되면 자주 실패합니다. 인플루언서 이미지를 사용했는데 Google 시스템이 민감하거나 실제 인물을 닮았다고 판단하면 생성이 실패하고 크레딧은 환불되지 않습니다. 인플루언서 얼굴이 포함된 토킹 영상에는 립싱크 기능을 대신 사용하세요 -- 인플루언서 콘텐츠에 훨씬 더 안정적입니다.

콘텐츠

Google Veo 3는 콘텐츠를 지원하지 않습니다. 영상은 또는 WAN 2.6 Flash를 사용하세요.

Veo 3가 뛰어난 분야

AI 생성 오리지널 얼굴

실제 인물 이미지보다 AI 생성 캐릭터에서 가장 잘 작동합니다. 오리지널 창작 콘텐츠에 이상적입니다.

추상적이고 예술적인 콘텐츠

실제 유명인을 참조하지 않는 비민감성 창작 콘텐츠에 탁월합니다.

Text-to-Video 생성

입력 이미지 없이 텍스트 설명만으로 완전한 장면을 만드는 데 가장 강력한 성능을 발휘합니다.

대화 생성

한 번의 패스로 자연스러운 립싱크, 음성, 환경 오디오와 함께 캐릭터가 말하는 영상을 생성할 수 있습니다.

최고의 시각 품질

2026년 SFW 콘텐츠 기준 가장 포토리얼리스틱한 AI 영상 출력입니다.

다양한 스타일 지원

포토리얼리스틱, Pixar 스타일, LEGO, 애니메이션, 클레이메이션, 그래픽 노블 등 다양한 비주얼 스타일을 지원합니다.


프롬프트 구조

잘 작성된 Veo 3 프롬프트는 Sora 2와 유사한 6가지 요소를 포함하지만, Veo 3만의 독특한 오디오 및 대화 기능이 차별점입니다.

Veo 3 프롬프트 구조 다이어그램 - 오디오-비주얼 요소

6가지 요소

  1. 피사체: 장면에 누가 또는 무엇이 있는지 -- 상세한 외모 묘사
  2. 맥락: 피사체가 어디에 있는지 -- 환경과 배경
  3. 행동: 무슨 일이 일어나고 있는지 -- 움직임, 제스처, 상호작용
  4. 스타일: 비주얼 미학 -- 시네마틱, 애니메이션, 다큐멘터리, 예술적
  5. 카메라 모션: 카메라가 어떻게 움직이는지 -- 트래킹, 돌리, 줌, 팬
  6. 오디오: 대화, 환경음, 음악, 효과음

기본 vs 상세 프롬프트

기본: 남자가 전화를 받는다

상세: 낡은 녹색 트렌치코트를 입은 절박한 남자가 거친 벽돌 벽에 설치된 로터리 전화기를 들어올린다. 녹색 네온 사인의 으스스한 빛 아래. 카메라는 멀리서 클로즈업까지 흔들리는 돌리 줌을 사용하며 그의 얼굴에 긴장감을 드러낸다. 네온 색감과 그림자의 배경. 전화벨과 먼 빗소리가 있는 긴장감 넘치는 앰비언트 음악.

Veo 3 프롬프트 구조 분석 및 주석이 달린 예시


대화와 음성

Veo 3의 가장 독특한 기능 중 하나는 동기화된 음성이 있는 캐릭터를 생성하는 것입니다. 이 점이 대부분의 다른 AI 영상 모델과 차별화됩니다.

대화 작성법

캐릭터 음성에는 콜론 형식을 사용하세요:

캐릭터가 말한다: "여기에 대사를 입력"

대화 모범 사례

대사를 짧게 유지

최대 8초의 대화. Veo 3 영상은 4-8초 길이이므로 대사를 간결하고 임팩트 있게 만드세요.

콜론 형식 사용

항상 'Character says:' 뒤에 따옴표로 된 대사를 사용하세요. 다른 형식은 일관되지 않은 결과를 낼 수 있습니다.

원치 않는 자막 방지

대사 뒤에 '(no subtitles!)'를 추가하여 Veo 3가 영상에 텍스트 오버레이를 추가하는 것을 방지하세요.

화자 지정

다중 캐릭터 장면에서는 누가 말하고 있는지 구체적으로 지정하여 생성 출력의 혼란을 방지하세요.

대화 예시

명시적 대화:

하얀 앞치마를 입은 셰프가 말한다: "The secret to perfect pasta is
timing!" (no subtitles!). 배경에서 부드러운 지글거리는 소리와
잔잔한 레스토랑 소음이 들리는 주방 소리.

암시적 대화:

셰프가 완벽한 파스타 조리법의 비밀을 설명한다 (no subtitles!).
지글거리는 소리와 식기 부딪히는 소리의 주방 분위기.

대화 vs 립싱크

AI 인플루언서의 긴 발언 영상에는 Veo 3 대화 대신 립싱크 기능을 사용하세요. 립싱크는 최대 10분의 오디오를 지원하며 인플루언서 얼굴 이미지와 안정적으로 작동합니다. Veo 3 대화는 짧은 오리지널 캐릭터 클립에 활용하세요.


오디오 프롬프팅

Veo 3는 각 영상에 오디오를 함께 생성합니다. 오디오 연출은 비주얼 연출만큼이나 중요합니다.

오디오 요소

  • 대화: 캐릭터가 말하는 내용 (콜론 형식 사용)
  • 환경 소음: 환경 관련 소리 (붐비는 거리, 카페, 바다)
  • 효과음: 구체적인 소리 (전화벨, 발자국, 유리잔 부딪히는 소리)
  • 음악: 배경 음악 스타일과 분위기 (소프트 재즈, 에픽 오케스트라)

오디오 예시

잔잔한 재즈 음악과 부드러운 카페 분위기, 에스프레소 머신 소리
중세 소리와 갑옷 부딪히는 소리의 에픽 오케스트라 음악
주방 소리, 부드러운 지글거리는 소리, 도마 위 칼 소리
새 지저귀는 소리, 나뭇잎 사이 부드러운 바람, 먼 개울 소리

원치 않는 오디오 방지

원치 않는 오디오 요소(예: 스튜디오 관객 웃음소리)가 나오면 구체적인 환경 오디오 설명을 추가하고 원치 않는 요소를 명시적으로 제외하세요. 예: "먼 밴드 소리, 시끄러운 군중, 바쁜 축제 현장의 배경 소음 (no studio audience)."


전문가 수준 프롬프트 예시

토킹 캐릭터 영상

카페 대화:

곱슬머리의 친근한 여성이 아늑한 카페에서 크림색 스웨터를
입고 카메라를 향해 따뜻한 미소를 짓는다. 그녀가 말한다:
"Welcome to our little coffee corner! I just made the most
amazing latte art, want to see?" (no subtitles!). 부드러운
재즈 음악과 잔잔한 카페 분위기가 배경에 흐른다.

여행 브이로그 셀카:

짧은 금발 머리에 빈티지 데님 재킷을 입은 여행 브이로거의
셀카 영상, 활기찬 도쿄 길거리 시장을 탐험 중. 팔을 뻗어
카메라를 잡고 팔이 화면에 보인다. 그녀가 말한다: "You have
to try this ramen place when you visit Tokyo - it's been
family-owned for 50 years!" (no subtitles!). 바쁜 시장과
먼 수다 소리의 배경 사운드.

요리 튜토리얼:

하얀 앞치마에 친근한 미소의 셰프가 현대적인 주방에서
손을 표현력 있게 움직이며 설명한다. 그가 말한다: "The
secret to perfect pasta is timing - al dente means it
should have just a tiny bite to it" (no subtitles!). 주방
소리와 부드러운 지글거리는 소리.

예술적 스타일 영상

Pixar 애니메이션:

Pixar 애니메이션 스타일로: 크고 표현력 있는 눈의 쾌활한
로봇이 미래 도시의 콘크리트 사이로 자라난 작은 꽃을
발견한다. 로봇이 경이로움으로 꽃을 부드럽게 만진다.
부드러운 바람 소리와 함께 잔잔한 오케스트라 음악.

LEGO 스타일:

LEGO 스타일로: LEGO 미니피규어 기사가 석양의 성벽 위에
영웅적으로 서 있고, 바람이 LEGO 깃발을 날린다.
중세 분위기의 에픽 시네마틱 음악.

애니메이션 스타일:

애니메이션 스타일로: 은빛 머리의 젊은 전사가 산꼭대기에
서서 떠다니는 섬이 있는 광활한 판타지 풍경을 내려다본다.
바람에 망토가 펄럭인다. 바람 소리와 함께 극적인
오케스트라 음악.

셀카 스타일 영상

Veo 3 해상도 및 품질 비교 - 다양한 출력

Veo 3는 진짜처럼 보이는 셀카 영상 제작에 뛰어납니다. 이 형식은 시청자가 개인적이고 카메라를 직접 보는 콘텐츠를 기대하는 소셜 미디어 플랫폼에서 뛰어난 성과를 보입니다.

셀카 영상 공식

  1. "A selfie video of..."로 시작
  2. 팔이 보이게 만들기: "holds the camera at arm's length, arm visible in frame"
  3. 자연스러운 시선 움직임 포함: "occasionally looking into the camera"
  4. 진짜 같은 텍스처 추가: "The image is slightly grainy, looks film-like"
  5. 캐릭터가 있는 환경 설명
  6. 자연스러운 환경 오디오 추가

이 형식은 진실되고 개인적인 느낌의 콘텐츠를 만들어 소셜 미디어 콘텐츠 제작바이럴 달성에 이상적입니다.


카메라 기법

Veo 3는 표준 촬영 용어에 잘 반응합니다. 프롬프트에 카메라 연출을 포함하면 출력의 품질과 전문성이 크게 향상됩니다.

움직임 유형

돌리 숏:

새벽 안개 낀 숲을 통과하는 느린 돌리 숏, 이끼로 덮인
고목들을 드러낸다. 부드러운 자연 소리, 새 지저귀는 소리,
나뭇잎 사이 부드러운 바람.

줌 아웃 리빌:

꽃잎 위 이슬방울 클로즈업에서 아침 햇빛 아래 야생화로
가득한 광활한 초원을 드러내는 극적인 줌 아웃.
평화로운 자연 분위기.

카메라 용어 참조

프롬프트에서 특정 카메라 워크를 위해 이 용어들을 사용하세요:

  • 아이 레벨: 표준 시점, 자연스럽고 공감하기 쉬움
  • 하이 앵글: 내려다보는 시점 -- 취약함이나 전체 조망 표현
  • 로우 앵글: 올려다보는 시점 -- 드라마와 힘의 느낌
  • 돌리 숏: 카메라가 트랙 위에서 앞뒤로 이동
  • 트래킹 숏: 카메라가 피사체를 측면으로 따라감
  • 팬 숏: 카메라가 고정점에서 수평으로 회전
  • 줌 인/아웃: 카메라 위치 고정 상태에서 초점 거리 변경

스타일 변주

Veo 3 모범 사례 요약 및 시각적 예시

Veo 3는 다양한 예술적 스타일을 지원합니다. 프롬프트 앞에 스타일 선언을 추가하면 일관된 결과를 얻을 수 있습니다.

사용 가능한 스타일

애니메이션 스타일

Pixar, 클레이메이션, South Park, LEGO, Simpsons -- 각각 독특한 시각적 특성을 가집니다.

예술적 스타일

그래픽 노블, 오리가미, 대리석 조각, 설계도, 8비트 레트로 -- 창의적 표현을 위한 스타일입니다.

시네마틱 스타일

포토리얼리스틱, 다큐멘터리, 빈티지 필름, 누아르 -- 전문적인 영상 콘텐츠를 위한 스타일입니다.


흔한 문제 방지하기

자막 방지

원치 않는 텍스트 오버레이는 Veo 3에서 가장 흔한 문제 중 하나입니다. 다음 규칙을 따르세요:

  • 대화를 사용할 때 항상 프롬프트에 "(no subtitles!)"를 추가
  • 대화에 콜론 형식 사용: says: "text"
  • 따옴표만 사용하는 형식 피하기: says "text" (자막 트리거 가능성 높음)
  • 자막이 계속 나타나면 끝에 "No subtitles. No subtitles!" 추가

캐릭터 일관성

여러 생성에서 시각적 일관성을 위해 캐릭터 설명을 동일하게 유지하세요:

Sarah, a woman in her early 30s with shoulder-length auburn hair,
warm brown eyes, wearing a cream linen blouse and gold necklace,
with a friendly and confident expression

이 캐릭터를 포함하는 모든 프롬프트에서 정확히 이 설명을 반복하세요. 이미지와 영상 전체에서 최대 캐릭터 일관성을 위해 MakeInfluencer.ai의 학습된 LoRA 모델을 사용하세요.


Veo 3 vs 다른 영상 모델

전체 비교는 2026 최고의 AI 영상 생성기 가이드를 참고하세요.

Feature
Veo 3
Sora 2
시각 품질
최고 수준
높음
대화 지원
자연스러운 음성 생성
제한적
오디오 품질
옵션과 함께 포함
기본 포함
콘텐츠 유연성
보통
엄격
비용
8,000 크레딧/초 (오디오 없음)
40,000+ 크레딧/영상
최적 용도
리얼리스틱 및 대화 콘텐츠
시네마틱 창작 콘텐츠

Veo 3를 선택하세요 -- 최고의 시각 품질, 대화 중심 콘텐츠, 포토리얼리스틱 출력에. Sora 2를 선택하세요 -- 시네마틱, 예술적 구도와 창의적 스토리텔링에. Kling v3.0를 선택하세요 -- 비용 효율적인 일상 콘텐츠와 Motion Control 댄스 영상에.


프로 팁 요약

항상 (no subtitles!) 추가

대화가 포함된 모든 프롬프트에 이것을 포함하여 영상에 원치 않는 텍스트 오버레이를 방지하세요.

음성에 콜론 형식 사용

Character says: 'Hello' -- 이 형식이 가장 안정적인 대화 생성 결과를 만듭니다.

오디오를 자세히 설명

환경음, 음악 스타일, 효과음을 구체적으로 지정하세요. 모호한 오디오 프롬프트는 평범한 결과를 낳습니다.

일관된 캐릭터 설명

같은 캐릭터에 대해 모든 프롬프트에서 동일한 외모 설명을 사용하여 시각적 연속성을 유지하세요.

카메라 연출 포함

카메라 움직임, 앵글, 프레이밍을 지정하여 일반적인 AI 영상 수준을 넘어서는 전문적인 결과를 만드세요.

스타일을 먼저 선언

프롬프트를 'In the style of...'로 시작하여 영상 전체에 일관된 미적 처리를 적용하세요.


자주 묻는 질문

Veo 3를 AI 인플루언서 이미지와 함께 사용할 수 있나요?

주의해서 사용하세요. Veo 3는 실제 인물과 닮은 이미지를 자주 거부합니다. AI 인플루언서의 얼굴이 포함된 안정적인 토킹 영상에는 립싱크 기능을 대신 사용하세요. Veo 3는 특정 얼굴이 필요 없는 오리지널 캐릭터 콘텐츠, 이스태블리싱 숏, 창의적 장면에 활용하세요.

Veo 3 생성이 실패한 이유는 무엇인가요?

가장 흔한 원인은: 입력 이미지가 실제 인물을 닮았거나 (AI 생성 얼굴을 대신 사용), 프롬프트에 저작권 참조가 포함되었거나, 콘텐츠가 로 판정된 경우입니다. 실패한 생성에 대해 크레딧은 환불되지 않으므로, 생성 전에 콘텐츠 정책을 검토하세요.

소셜 미디어에 최적의 영상 길이는?

Veo 3는 4-8초 영상을 생성합니다. TikTok과 Reels에는 훅, 전환, 독립형 클립으로 이상적입니다. 더 긴 콘텐츠는 편집기에서 여러 Veo 3 클립을 결합하거나 최대 10분의 토킹 헤드 영상을 위해 립싱크를 사용하세요.

최고의 대화 품질을 얻으려면?

대화를 8초 이내로 유지하세요. 콜론 형식("Character says:")을 사용하세요. 텍스트 오버레이를 방지하기 위해 "(no subtitles!)"를 추가하세요. 캐릭터의 말하는 방식("따뜻하고 열정적으로" vs "차분하고 절제된")을 설명하세요. 환경 오디오를 포함하여 대화를 사실적인 환경에 배치하세요.

Veo 3를 MakeInfluencer.ai의 다른 기능과 결합할 수 있나요?

네. Veo 3는 시네마틱 이스태블리싱 숏과 B-roll에 사용하고, Motion Control 댄스 영상과 립싱크 토킹 헤드와 결합하면 완전한 콘텐츠 패키지를 만들 수 있습니다. AI 이미지 생성으로 영상 파이프라인에 투입할 캐릭터 이미지를 제작하세요.

Veo 3 가격은 어떻게 되나요?

Veo 3는 오디오 없이 초당 8,000 크레딧, 오디오 포함 시 초당 12,000 크레딧입니다. 오디오가 포함된 일반적인 8초 영상은 96,000 크레딧이 소요됩니다. 더 예산 친화적인 워크플로우를 위해 초당 4,000 크레딧인 Kling v3.0 Standard와 비교해 보세요.


Veo 3로 제작 시작하기

Veo 3는 2026년 가장 시각적으로 인상적인 AI 영상 모델입니다. 프롬프트 기법을 마스터하면 전문 영상 프로덕션에 필적하는 콘텐츠를 그 비용의 일부로 제작할 수 있습니다.

1

MakeInfluencer.ai 가입

계정을 만들고 플랜을 선택하면 바로 Veo 3 영상 생성을 시작할 수 있습니다.

2

Text-to-Video로 시작

모델을 배우는 동안 유명인 감지 문제를 피하기 위해 T2V 프롬프트(입력 이미지 없음)로 시작하세요.

3

6가지 요소 연습

최상의 결과를 위해 모든 프롬프트에 피사체, 맥락, 행동, 스타일, 카메라 모션, 오디오를 포함하세요.

4

대화 실험

(no subtitles!)와 함께 콜론 대화 형식을 시도하여 토킹 캐릭터 클립을 만들어 보세요.

5

콘텐츠 파이프라인 구축

Veo 3 시네마틱 클립을 Motion Control 및 립싱크와 결합하여 완전한 AI 영상 워크플로우를 구축하세요.

MakeInfluencer.ai에서 Veo 3로 제작 시작하기

직접 해볼 준비가 되셨나요?

AI 인플루언서 제작과 콘텐츠 생성을 몇 분 만에 시작할 수 있습니다.