k
korAI
AI 뉴스 전체
📰 AI 뉴스2026-07-094분

Meta, Llama 4 Maverick 멀티모달 API 공개—이미지·텍스트 혼합 추론 오픈소스 진입

Meta가 Llama 4 Maverick 모델의 멀티모달 추론 기능을 공식 API 및 오픈소스 가중치로 동시 공개했다. 이미지와 텍스트를 단일 컨텍스트에서 처리하는 400B 혼합 전문가(MoE) 구조로, 개발자가 자체 서버에 배포하거나 Meta AI API를 통해 즉시 호출할 수 있다.

metaopensourcemultimodal

Llama 4 Maverick 멀티모달 구조 개요

Llama 4 Maverick는 총 400B 파라미터를 갖춘 MoE(Mixture-of-Experts) 모델로, 추론 시 활성화되는 파라미터는 약 17B 수준이다. 이번 업데이트로 최대 해상도 1,120×1,120 이미지를 최대 8장까지 단일 요청에 포함할 수 있으며, 컨텍스트 창은 텍스트 기준 128K 토큰을 지원한다. 가중치는 Llama 4 Community License 하에 공개되며 상업적 사용 시 월간 활성 사용자 7억 명 초과 시점부터 별도 계약이 필요하다.

오픈소스 배포 옵션과 하드웨어 요구사항

Hugging Face Hub를 통해 BF16 전체 정밀도 가중치와 INT4 GPTQ 양자화 버전을 모두 내려받을 수 있다. INT4 양자화 기준 A100 80GB GPU 2장으로 배치 크기 1~4의 추론이 가능하며, vLLM 0.6.x 이상에서 --model meta-llama/Llama-4-Maverick 플래그 하나로 멀티모달 엔드포인트가 자동 구성된다. 한국 내 GPU 클라우드(네이버 클라우드 HPC, NHN Cloud GPU) 환경에서도 동일한 방식으로 배포할 수 있음이 커뮤니티를 통해 확인됐다.

크리에이터·개발자 활용 시나리오

이미지 설명 자동화, UI 스크린샷 기반 버그 리포트 생성, 상품 이미지 메타데이터 자동 태깅 등 기존에 유료 API에 의존하던 멀티모달 워크플로를 자체 인프라에서 처리할 수 있게 된다. API 호출 단가는 Meta AI API 기준 공식 페이지 참조. 오픈소스 자체 배포 시 인프라 비용만 부담하면 되므로, 대량 이미지 처리 파이프라인에서 비용 절감 효과가 클 것으로 예상된다.

출처: Meta AI 공식 블로그