Google DeepMind, Veo 3 영상 생성 API 정식 GA — 크리에이터 워크플로우 직접 통합 가능
Google DeepMind가 텍스트·이미지 프롬프트 기반 영상 생성 모델 Veo 3를 Vertex AI API로 정식 공개(GA)했다. 최대 1080p·60fps 출력과 오디오 동기 생성을 지원하며, 한국어 프롬프트 처리 품질이 대폭 개선되어 국내 영상 크리에이터와 앱 개발자가 서비스에 직접 내장할 수 있게 됐다.
Veo 3 API 정식 GA 개요
Google DeepMind는 2026년 9월 7일(현지 시각) Veo 3 영상 생성 모델을 Google Cloud Vertex AI를 통해 정식 GA(General Availability)로 전환했다. 기존 프리뷰 단계에서는 허용 대기열(waitlist) 방식으로 제한 접근이었으나, GA 전환 이후 Vertex AI 콘솔에서 프로젝트 활성화만으로 즉시 호출 가능하다.
주요 출력 사양은 다음과 같다.
- 해상도: 최대 1920×1080(1080p)
- 프레임레이트: 최대 60fps
- 영상 길이: 단일 요청당 최대 60초
- 오디오: 배경음·효과음 동기 생성 지원(별도 파라미터)
- 입력 모달리티: 텍스트 프롬프트, 레퍼런스 이미지, 스타일 시드 이미지 병용 가능
한국어 프롬프트 처리 및 API 사용법
이번 GA에서 가장 주목할 변화는 한국어 네이티브 프롬프트 처리 품질 개선이다. 기존 프리뷰 버전에서는 한국어 프롬프트를 내부적으로 영어로 번역 후 처리하는 과정에서 의미 손실이 발생했으나, GA 버전은 멀티링궐 인코더를 업그레이드해 한국어 문장 구조·조사·어미 맥락을 직접 반영한다.
기본 Python 호출 예시:
from google.cloud import aiplatform
aiplatform.init(project="your-project-id", location="asia-northeast3")
client = aiplatform.gapic.PredictionServiceClient()
response = client.predict(
endpoint="projects/your-project-id/locations/asia-northeast3/publishers/google/models/veo-003",
instances=[{
"prompt": "한강 야경을 배경으로 달리는 자전거, 시네마틱, 슬로우모션",
"duration_seconds": 10,
"aspect_ratio": "16:9",
"resolution": "1080p",
"generate_audio": True
}]
)
asia-northeast3(서울 리전) 엔드포인트가 정식 지원되어 레이턴시 절감 효과도 기대된다.
가격은 생성 초(second) 단위로 과금되며, 정확한 단가는 공식 페이지 참조. 월 무료 크레딧 한도는 Vertex AI 신규 계정 기준 $300 공통 크레딧에서 차감된다.
크리에이터·개발자 활용 시나리오
쇼츠·릴스 자동화 파이프라인: 텍스트 스크립트 → Veo 3 영상 생성 → 자막 합성 → 플랫폼 업로드를 단일 파이프라인으로 구성할 수 있다. 오디오 동기 생성 기능 덕분에 별도 BGM 편집 단계를 줄일 수 있어 1인 크리에이터 제작 시간 단축에 직접적으로 유리하다.
광고·커머스 영상: 레퍼런스 이미지(제품 컷)를 시드로 넣어 다양한 배경과 앵글의 영상 변형을 대량 생성하는 A/B 테스트 소재 자동화가 가능하다.
인터랙티브 앱 내장: 사용자가 입력한 텍스트로 실시간(비동기) 영상을 생성해 앱 내에서 보여주는 UGC(User Generated Content) 기능 구현이 Vertex AI SDK 단일 의존성으로 가능해졌다.
주의사항: 생성 영상에는 Google의 SynthID 워터마크(불가시 메타데이터)가 자동 삽입되며, 상업 배포 시 Google Cloud 서비스 약관 및 생성 AI 콘텐츠 정책 준수가 필수다.