k
korAI
AI 뉴스 전체
📰 AI 뉴스2026-07-154분

Google DeepMind, Veo 3 영상 생성 API 정식 GA—개발자 직접 통합 가능

Google DeepMind가 텍스트·이미지 프롬프트 기반 고품질 영상 생성 모델 Veo 3의 API를 Vertex AI를 통해 정식 GA로 전환했다. 최대 1080p 해상도와 오디오 동기화 생성을 지원하며, 크리에이터 툴·콘텐츠 플랫폼 개발자가 영상 파이프라인에 직접 임베드할 수 있게 됐다. 기존 이미지 생성 워크플로우 대비 멀티모달 미디어 자동화 범위가 크게 확장된다는 점에서 한국 미디어테크·광고테크 스타트업에도 직접적인 영향이 예상된다.

google-deepmindvideo-generationvertex-ai

Veo 3 API 핵심 스펙

Veo 3는 텍스트 프롬프트 또는 레퍼런스 이미지를 입력으로 받아 최대 1080p 해상도, 60fps 영상 클립을 생성한다. 단일 클립 최대 길이는 8초이며, 오디오 트랙(음악·효과음·배경음)을 영상과 동기화해 함께 출력하는 기능이 정식 지원된다. API 응답 형식은 GCS(Google Cloud Storage) URI 또는 Base64 바이너리 스트림 중 선택 가능하다.

| 항목 | 스펙 | |---|---| | 최대 해상도 | 1080p | | 최대 프레임레이트 | 60fps | | 단일 클립 길이 | 최대 8초 | | 입력 모달리티 | 텍스트 / 이미지+텍스트 | | 오디오 동기화 생성 | 지원 | | 제공 플랫폼 | Vertex AI (Generative AI Studio 포함) | | 가격 | 공식 페이지 참조 |

개발자 통합 포인트

Vertex AI SDK(Python·Node.js·Java)를 통해 기존 Imagen 3 코드 패턴과 유사한 방식으로 호출할 수 있어 마이그레이션 비용이 낮다. GenerativeModel('veo-003') 엔드포인트를 지정하고 generate_video() 메서드에 프롬프트와 파라미터를 전달하는 구조다.

주요 파라미터

  • aspect_ratio: 16:9 / 9:16 / 1:1 선택 가능 (숏폼·광고 세로 영상 대응)
  • negative_prompt: 제외할 시각 요소 지정
  • seed: 재현성 확보를 위한 고정 시드 지원
  • enhance_prompt: Gemini 기반 프롬프트 자동 보강 옵션

비동기 방식(Long-Running Operation)으로 응답하므로 폴링 또는 Pub/Sub 콜백으로 결과를 수신하는 패턴이 권장된다. 생성 소요 시간은 클립 길이·해상도에 따라 30초~3분 내외로 보고되고 있다.

한국 개발자·크리에이터 활용 시나리오

광고테크: 제품 이미지를 입력해 15초 광고 소재를 자동 생성하는 파이프라인 구축이 가능하다. A/B 테스트용 영상 소재를 대량 생산하는 데 특히 유효하다.

교육 콘텐츠: 텍스트 스크립트로부터 설명 애니메이션을 자동 생성해 이러닝 플랫폼의 콘텐츠 제작 비용을 줄일 수 있다.

소셜 미디어 자동화: 숏폼(9:16) 지원과 오디오 동기화 생성을 활용해 릴스·쇼츠 형식의 콘텐츠를 프로그래매틱하게 생산하는 워크플로우를 구성할 수 있다.

다만 현재 GA 단계에서는 일부 리전에서만 가용하며, 한국 리전(asia-northeast3) 지원 여부는 Vertex AI 콘솔의 모델 가든에서 직접 확인이 필요하다. 콘텐츠 안전 필터는 기본 활성화되어 있으며, 생성 영상에는 SynthID 워터마크가 비가시적으로 삽입된다.

출처: Google DeepMind Blog / Vertex AI Release Notes