k
korAI
📰 AI 뉴스

AI 뉴스

매일 3개 자동 업데이트 · 공식 발표와 실전 경험을 기반으로 큐레이션합니다.

2026-09-18·3
2026-09-17·3
2026-09-16·3

Google, Gemini Code Assist Enterprise 정식 GA — IDE 무관 멀티에이전트 코드 리뷰 지원

Google DeepMind가 Gemini Code Assist Enterprise를 정식 출시하며 VS Code·JetBrains·Neovim 등 주요 IDE에서 멀티에이전트 기반 자동 코드 리뷰와 취약점 탐지를 지원한다. 기존 단일 모델 제안 방식에서 벗어나 리뷰 에이전트·보안 에이전트·테스트 생성 에이전트가 병렬로 동작하며, 엔터프라이즈 플랜 기준 사용자당 월 $19(공식 페이지 참조)로 책정됐다. 한국 GCP 서울 리전(asia-northeast3)에서 즉시 사용 가능해 데이터 레지던시 요건을 충족하는 팀에게 특히 유효하다.

4분googlecode-assist

Anthropic, Claude Opus 4.7 파인튜닝 프리뷰 공개 — 최대 100K 토큰 컨텍스트 학습 지원

Anthropic이 Claude Opus 4.7 대상 파인튜닝 API를 비공개 프리뷰로 공개하고 엔터프라이즈 고객 대상 얼리 액세스 신청을 받기 시작했다. 기존 Haiku 4.5 수준에서만 가능했던 파인튜닝이 Opus 4.7로 확장되며, 단일 학습 예제에서 최대 100K 토큰의 컨텍스트를 그대로 사용할 수 있어 장문 기술 문서·법률·의료 도메인 특화 모델 구축이 가능해진다. 학습 데이터는 Anthropic 인프라 내에서만 처리되며 모델 개선에 사용되지 않는다고 공식 문서에 명시됐다.

5분anthropicfine-tuning

OpenAI, DPO 파인튜닝 정식 GA — 라벨 없이 선호 데이터로 모델 정렬

OpenAI가 Direct Preference Optimization(DPO) 방식의 파인튜닝을 Fine-tuning API에서 정식 지원한다. 기존 SFT(지도 학습) 방식과 달리 '좋은 응답 vs 나쁜 응답' 쌍만 있으면 별도 라벨링 없이 모델 행동을 교정할 수 있어, 한국어 특화 응답 품질 개선이나 도메인 톤앤매너 조정 비용이 크게 줄어든다.

4분openaifine-tuning
2026-09-15·3

Cursor 0.52, MCP 네이티브 통합 정식 GA — 서버 자동 탐색 지원

Cursor가 버전 0.52에서 Model Context Protocol(MCP) 서버를 IDE 내부에서 직접 설치·관리하는 네이티브 통합을 정식 출시했다. 별도 CLI 설정 없이 마켓플레이스에서 원클릭으로 MCP 서버를 추가할 수 있어, 외부 도구 연동 워크플로가 대폭 단순화된다. 데이터베이스·Figma·Linear 등 30개 이상의 공식 서버가 출시 시점에 함께 제공된다.

4분cursormcp

EU AI Act 2단계 의무 발효 — 한국 SaaS의 GPAI 규정 준수 체크리스트

EU AI Act의 범용 AI(GPAI) 모델 투명성 의무가 2026년 9월 15일부로 본격 집행에 들어가며, EU 사용자를 보유한 한국 SaaS 스타트업도 직접 규제 대상에 포함된다. 연간 학습 연산량이 10²⁵ FLOP을 초과하는 모델을 서비스에 통합·배포하는 사업자는 기술 문서 제출 및 저작권 정책 공개 의무를 이행해야 한다. 미준수 시 전 세계 연간 매출의 최대 3% 또는 1,500만 유로 중 높은 금액이 과징금으로 부과된다.

5분ai-policyeu-ai-act

Anthropic, Files API 정식 GA — 최대 32GB 파일 영구 저장·재사용 지원

Anthropic이 Claude API에서 파일을 업로드·저장·재사용할 수 있는 Files API를 정식 GA로 출시했다. 기존에는 API 호출마다 파일을 재전송해야 했으나, 이제 한 번 업로드한 파일을 최대 30일간 보관하고 여러 요청에서 참조할 수 있어 비용과 레이턴시가 크게 줄어든다. 대용량 코드베이스·문서 분석 워크플로를 자동화하는 한국 개발팀에게 실질적인 토큰 절감 효과가 기대된다.

4분anthropicapi
2026-09-14·2
2026-09-13·3

OpenAI, Batch API v2 정식 GA — 처리량 10배·결과 스트리밍 지원

OpenAI가 Batch API v2를 정식 출시하며 단일 배치당 최대 10만 건 요청 처리와 결과 부분 스트리밍을 지원한다. 기존 v1 대비 처리량이 최대 10배 늘었고 비용은 표준 API 요금의 50%가 유지되어, 대량 데이터 파이프라인을 운영하는 개발자에게 직접적인 비용 절감 효과가 기대된다.

3분openaiapi

DeepMind, AlphaCode 3 공개 — 경쟁 프로그래밍 정확도 78% 달성

Google DeepMind가 AlphaCode 3를 발표하며 Codeforces 기준 상위 2% 수준에 해당하는 문제 해결률 78%를 기록했다고 밝혔다. 이전 버전 대비 다단계 추론과 자기 검증(self-debugging) 루프가 강화됐으며, Gemini 2.5 Ultra 기반으로 재설계되어 API를 통한 외부 접근도 예고됐다.

4분deepmindcode-generation

Meta, Llama 4 Maverick 함수 호출 정식 GA — 병렬 툴 콜 최대 16개 지원

Meta가 Llama 4 Maverick의 함수 호출(Function Calling) 기능을 정식 GA로 전환하며, 단일 추론 패스에서 병렬 툴 콜을 최대 16개까지 실행할 수 있도록 스펙을 확정했다. JSON Schema 기반 툴 정의와 강제 툴 선택(tool_choice: required) 모드를 지원해 에이전트 파이프라인 구축이 크게 간소화된다. 오픈웨이트 모델로 로컬·온프레미스 배포가 가능해 API 비용 없이 함수 호출 워크플로를 내재화하려는 한국 개발팀에 실질적인 대안이 된다.

4분metallama
2026-09-12·3
2026-09-11·3
2026-09-10·3

Anthropic, Claude Opus 4.7 Files API 정식 GA — 최대 50GB 영속 파일 스토리지 지원

Anthropic이 Claude Opus 4.7을 대상으로 Files API를 정식 출시하며, 업로드한 파일을 최대 30일간 서버에 보관하고 여러 대화에서 재사용할 수 있게 됐다. 기존에 매 요청마다 파일을 첨부해야 했던 RAG 파이프라인 구조가 단순화되고, 대용량 코드베이스·디자인 에셋 처리 비용이 크게 줄 것으로 기대된다.

4분anthropicapi

Google DeepMind, Gemma 3n 온디바이스 추론 정식 공개 — 모바일 NPU 최적화 가중치 포함

Google DeepMind가 스마트폰·엣지 디바이스를 겨냥한 오픈웨이트 모델 Gemma 3n을 Hugging Face와 Kaggle을 통해 정식 배포했다. E2B(Effective 2B)·E4B 두 가지 사이즈로 제공되며, Android MediaPipe LLM Inference API와 직결되어 한국 모바일 앱 개발자의 온디바이스 AI 통합 허들이 크게 낮아질 전망이다.

4분google-deepmindopen-source

Meta, Llama 4 Scout에 코드 인터프리터 정식 통합 — 로컬 실행 지원

Meta가 오픈웨이트 모델 Llama 4 Scout에 코드 인터프리터 기능을 정식 통합하고, 로컬 환경에서도 샌드박스 실행이 가능한 런타임 사양을 함께 공개했다. 기존 클라우드 의존 없이 Python·JavaScript 코드 생성과 즉시 실행 결과를 단일 추론 루프 안에서 처리할 수 있어, 폐쇄망 환경이 많은 국내 금융·공공 개발팀에 직접적인 대안이 생겼다.

4분metallama
2026-09-09·3

Cursor, 백그라운드 에이전트 정식 GA — 로컬 터미널 없이 병렬 작업

Cursor가 클라우드 기반 백그라운드 에이전트를 정식 출시하며, 개발자가 로컬 IDE를 열지 않아도 PR 생성·테스트 실행·리팩터링을 비동기로 처리할 수 있게 됐다. 최대 10개 작업을 동시에 병렬 실행할 수 있어 대규모 코드베이스 유지보수 효율이 크게 향상될 전망이다.

4분cursordeveloper-tools

한국 AI 기본법 시행령 입법예고 — 고위험 AI 의무 공개 범위 확정

과학기술정보통신부가 「인공지능 발전과 신뢰 기반 조성 등에 관한 법률」 시행령 초안을 입법예고하며, 고위험 AI 시스템의 의무 고지·로그 보관 기준이 처음으로 구체화됐다. 서비스형 AI(SaaS)를 개발·운영하는 스타트업과 1인 크리에이터 플랫폼도 적용 대상에 포함될 수 있어 즉각적인 컴플라이언스 검토가 필요하다.

5분ai-policyregulation

Claude Code, 서브에이전트 오케스트레이션 정식 GA — 태스크 병렬 분기 최대 10개

Anthropic이 Claude Code의 서브에이전트 오케스트레이션 기능을 정식 GA로 전환했다. 단일 프롬프트에서 최대 10개의 서브에이전트를 병렬 분기·실행할 수 있으며, 각 에이전트는 독립적인 컨텍스트 창을 유지해 대규모 코드베이스 리팩터링·테스트 자동화 파이프라인 구축에 즉시 활용 가능하다. 한국 개발자들이 주로 사용하는 VS Code 및 JetBrains 플러그인에도 동시 업데이트가 적용됐다.

4분claude-codeagents
2026-09-08·3

Anthropic, Claude Sonnet 4.6 확장 사고 모드 정식 GA — 토큰 예산 제어 API 공개

Anthropic이 Claude Sonnet 4.6의 확장 사고(Extended Thinking) 모드를 정식 GA로 전환하고, 개발자가 추론 토큰 예산을 세밀하게 제어할 수 있는 `thinking` 파라미터 API를 공개했다. 기존 베타 대비 최대 사고 토큰 한도가 32,000토큰으로 확대되어 복잡한 수학·코드 디버깅 태스크에서 체감 정확도가 향상됐다. 한국 개발자는 API 키 재발급 없이 즉시 적용 가능하며, 추론 토큰 과금 구조는 공식 페이지를 참조해야 한다.

4분anthropicllm

Meta, Llama 4 Maverick 함수 호출 정식 지원 — 한국어 Tool Use 벤치마크 동시 공개

Meta가 Llama 4 Maverick 모델에 구조화된 함수 호출(Function Calling) 기능을 공식 추가하고, JSON 스키마 기반 Tool Use 인터페이스를 오픈소스로 공개했다. 동시에 한국어 포함 다국어 Tool Use 벤치마크 결과를 Hugging Face에 업로드해, 로컬 배포 환경에서의 한국어 에이전트 신뢰도를 독립적으로 검증할 수 있게 됐다. 이번 업데이트는 오픈소스 에이전트 프레임워크(LangChain, LlamaIndex 등)와의 네이티브 통합을 직접 겨냥한 것으로, 자체 인프라를 운영하는 한국 개발팀에게 클라우드 종속 없는 에이전트 구축 선택지가 생겼다.

5분metaopensource

Mistral AI, 오픈웨이트 Mistral Large 3 정식 공개 — 상업 라이선스 포함

Mistral AI가 Mistral Large 3를 오픈웨이트 방식으로 공개하며 상업적 사용을 허용하는 라이선스를 동시 적용했다. 128K 컨텍스트와 다국어 코드 생성 성능이 강화되어 한국 개발자가 자체 인프라에 직접 배포할 수 있는 현실적인 대안으로 부상하고 있다.

4분open-sourcellm
2026-09-07·3
2026-09-06·3
2026-09-05·3
2026-09-04·3
2026-09-03·1
2026-08-01·2
2026-07-31·2
2026-07-30·3
2026-07-29·3
2026-07-28·3
2026-07-27·3

Google DeepMind, Gemini Robotics API 정식 공개—멀티모달 물리 추론 외부 접근

Google DeepMind가 로봇·물리 환경 제어에 특화된 Gemini Robotics API를 오늘부로 외부 개발자에게 정식 공개했다. 카메라 피드, 센서 데이터, 자연어 명령을 단일 컨텍스트로 처리하는 멀티모달 추론이 핵심으로, 하드웨어 없이 시뮬레이터 환경에서도 즉시 테스트할 수 있어 한국 로봇·IoT 스타트업의 진입 장벽이 크게 낮아질 전망이다.

4분googlerobotics

Anthropic, Claude Haiku 4.5 배치 API 처리량 한도 5배 상향—비용 구조 개편

Anthropic이 Claude Haiku 4.5 모델의 배치(Batch) API 처리량 한도를 기존 대비 5배 높이고, 대용량 처리 시 추가 할인을 적용하는 가격 구조 개편을 오늘 공식 발표했다. 반복적인 텍스트 분류, 코드 리뷰 자동화, 대규모 콘텐츠 파이프라인을 운영하는 팀에게 직접적인 비용 절감 효과가 기대된다.

4분anthropicapi

Hugging Face, 추론 프로바이더 API 한국 리전 정식 지원 시작

Hugging Face Inference Providers가 AWS Seoul(ap-northeast-2) 리전을 정식 지원하기 시작하면서, 한국 개발자는 오픈소스 모델 추론 레이턴시를 기존 대비 최대 60% 줄일 수 있게 됐다. Llama 4 Scout, Mistral Small 3.2, Qwen2.5-Coder-32B 등 주요 모델이 서울 엔드포인트에서 즉시 호출 가능하며, 기존 Inference API 코드 변경 없이 region 파라미터만 추가하면 전환된다.

4분huggingfaceinference
2026-07-26·3
2026-07-25·3
2026-07-24·3

Anthropic, Claude Code SDK 다국어 지원 정식 GA—Python·TypeScript 외 Go·Rust 추가

Anthropic이 Claude Code SDK에 Go 및 Rust 언어 바인딩을 정식 추가하며 멀티언어 에이전트 개발 환경을 확장했다. 기존 Python·TypeScript 중심 워크플로에서 벗어나 시스템 프로그래밍 언어로도 Claude Sonnet 4 기반 코딩 에이전트를 직접 임베드할 수 있게 되어, 서버·임베디드 환경 개발자의 도입 장벽이 크게 낮아졌다.

4분claudesdk

Google, Gemini 2.5 Flash 추론 토큰 비용 40% 인하—Thinking 예산 제어 API 추가

Google DeepMind가 Gemini 2.5 Flash의 내부 추론(Thinking) 토큰 단가를 기존 대비 40% 인하하고, 개발자가 추론 깊이를 0~24,576 토큰 범위에서 직접 제어할 수 있는 `thinkingBudget` 파라미터를 Google AI Studio 및 Vertex AI에 정식 추가했다. 이로써 비용과 응답 품질 사이의 트레이드오프를 코드 한 줄로 조정할 수 있게 되어, 예산 민감한 스타트업 및 프리랜서 개발자의 실사용 접근성이 높아졌다.

4분geminigoogle-deepmind

Meta, Llama 4 Behemoth API 정식 공개—2조 파라미터 추론 외부 접근 허용

Meta가 Llama 4 Behemoth 모델의 외부 API 접근을 정식 GA로 전환하며, 개발자는 Meta AI API를 통해 직접 호출할 수 있게 됐다. 기존 Scout·Maverick 대비 수학·코딩 벤치마크에서 최대 38% 높은 성능을 기록해 복잡한 추론 파이프라인 구축에 새로운 선택지가 생겼다.

4분metallama
2026-07-23·3
2026-07-22·3
2026-07-21·3
2026-07-20·3
2026-07-19·3
2026-07-18·3

OpenAI Codex CLI, 터미널 네이티브 코딩 에이전트 정식 GA

OpenAI가 터미널에서 직접 동작하는 코딩 에이전트 Codex CLI를 정식 출시했다. 로컬 파일시스템 읽기·쓰기·실행을 자율 수행하며, o3 및 o4-mini 모델을 백엔드로 선택할 수 있어 비용과 속도를 상황에 따라 조절할 수 있다. Cursor 없이 순수 CLI 환경에서 에이전트 루프를 돌리고 싶은 백엔드·데브옵스 개발자에게 직접적인 대안이 된다.

4분openaicli

Google Gemini API, 암묵적 컨텍스트 캐싱 정식 도입—긴 프롬프트 비용 최대 75% 절감

Google DeepMind가 Gemini 1.5 Pro·Flash 대상으로 '암묵적 컨텍스트 캐싱(Implicit Context Caching)'을 정식 활성화했다. 동일 프리픽스 토큰이 반복 요청에 재사용되면 자동으로 캐시가 적용되며, 개발자가 별도 API 호출 없이 비용 절감 효과를 누릴 수 있다. 대형 시스템 프롬프트나 RAG 문서 청크를 고정으로 사용하는 서비스에서 즉각적인 인프라 비용 감소가 기대된다.

4분googlegemini

Gemini 2.5 Flash, '생각 예산' 토큰 제어 API 정식 공개

Google DeepMind가 Gemini 2.5 Flash의 추론 단계(thinking)에 소비되는 토큰 상한을 개발자가 직접 지정할 수 있는 'Thinking Budget' 파라미터를 Google AI Studio 및 Gemini API에 정식 반영했다. 간단한 태스크에는 추론 토큰을 최소화해 비용과 지연을 동시에 낮추고, 복잡한 코드 리뷰·수학 풀이에는 예산을 늘려 정확도를 높이는 식으로 워크로드별 최적화가 가능해진다. 한국 개발자들이 빌드하는 RAG 파이프라인이나 코딩 에이전트에서 응답 품질과 API 비용 사이의 트레이드오프를 코드 한 줄로 조정할 수 있다는 점에서 실무 영향이 크다.

4분googlegemini
2026-07-17·3
2026-07-16·2
2026-07-15·3

Meta, Llama 4 Maverick 함수 호출 API 정식 GA—멀티턴 툴 체이닝 지원

Meta가 Llama 4 Maverick 모델에 함수 호출(Function Calling)과 멀티턴 툴 체이닝을 정식 지원하며 개발자 API를 GA로 전환했다. 기존 오픈소스 모델 대비 구조화된 출력 정확도가 높아져 에이전트 파이프라인 구성이 한층 간결해진다. Hugging Face와 Together AI를 통한 호스팅 엔드포인트도 동시에 제공되어 별도 인프라 없이 즉시 사용 가능하다.

4분metallama

Anthropic, MCP 공식 레지스트리 런칭—검증된 서버 목록 중앙 관리

Anthropic이 Model Context Protocol(MCP) 서버를 중앙에서 검색·설치할 수 있는 공식 레지스트리를 정식 공개했다. 보안 감사를 통과한 서버만 등록되며, Claude Code와 Claude Desktop에서 원클릭 설치가 가능해진다. 난립하던 서드파티 MCP 서버의 신뢰성 문제를 공식 채널로 해결한다는 점에서 에이전트 개발 생태계에 중요한 전환점이 될 전망이다.

4분anthropicmcp

Google DeepMind, Veo 3 영상 생성 API 정식 GA—개발자 직접 통합 가능

Google DeepMind가 텍스트·이미지 프롬프트 기반 고품질 영상 생성 모델 Veo 3의 API를 Vertex AI를 통해 정식 GA로 전환했다. 최대 1080p 해상도와 오디오 동기화 생성을 지원하며, 크리에이터 툴·콘텐츠 플랫폼 개발자가 영상 파이프라인에 직접 임베드할 수 있게 됐다. 기존 이미지 생성 워크플로우 대비 멀티모달 미디어 자동화 범위가 크게 확장된다는 점에서 한국 미디어테크·광고테크 스타트업에도 직접적인 영향이 예상된다.

4분google-deepmindvideo-generation
2026-07-14·3

Anthropic, Claude Sonnet 4.6 배치 처리량 2배 상향—대규모 문서 파이프라인 비용 절감

Anthropic이 Claude Sonnet 4.6의 배치 API 처리량 한도를 기존 대비 2배로 상향하고, 병렬 요청 최적화를 통해 대용량 문서 분석·번역·요약 파이프라인의 실질 비용을 낮췄다. 한국어 토크나이저 효율도 함께 개선되어 동일 토큰 예산으로 처리할 수 있는 한국어 문서량이 약 15% 증가했다.

3분anthropicapi

EU AI Act 고위험 시스템 조항 본격 시행—한국 SaaS의 EU 출시 체크리스트

2026년 7월 14일부로 EU AI Act의 고위험(High-Risk) AI 시스템 관련 조항이 정식 발효되어, EU 시장에 서비스를 제공하는 한국 개발자·스타트업도 적합성 평가와 문서화 의무를 이행해야 한다. 의료·채용·신용평가 등 열거된 분야의 AI 기능을 포함한 제품은 출시 전 준수 여부를 점검해야 하며, 위반 시 전 세계 연간 매출의 최대 3%가 과징금으로 부과된다.

4분ai-policyregulation

Anthropic, Claude Haiku 4.5 병렬 툴 호출 정식 지원—에이전트 응답 속도 40% 단축

Anthropic이 Claude Haiku 4.5에 병렬 함수 호출(Parallel Tool Use) 기능을 정식 GA로 활성화했다. 단일 턴에서 여러 외부 API를 동시에 호출할 수 있어 다단계 에이전트 워크플로의 전체 레이턴시가 최대 40% 줄어든다. 비용 효율이 높은 Haiku 4.5 티어에서 이 기능이 해제됨에 따라, 실시간 응답이 중요한 챗봇·검색 보강(RAG) 파이프라인 구축 비용 구조가 크게 개선될 전망이다.

4분anthropicagents
2026-07-13·3
2026-07-12·3
2026-07-11·3
2026-07-10·3
2026-07-09·2
2026-07-08·3

Cursor 0.50, 멀티 에이전트 컨텍스트 고정 기능 정식 출시

Cursor 0.50 업데이트에서 Agent Mode에 '컨텍스트 핀(Context Pin)' 기능이 정식 추가되어, 긴 세션에서도 핵심 파일·규칙이 자동 증발하지 않고 유지된다. 대규모 코드베이스를 다루는 개발자의 고질적 문제였던 컨텍스트 드리프트가 구조적으로 해소되어 장기 리팩터링 작업 생산성이 크게 향상될 전망이다.

3분cursoragent

한국 AI 기본법 시행령 확정—고영향 AI 고지 의무 내년 1월 발효

과학기술정보통신부가 「인공지능 발전과 신뢰 기반 조성 등에 관한 법률」 시행령 최종본을 오늘 관보에 게재했다. 핵심은 '고영향 AI' 서비스 제공자에게 이용자 고지 및 설명 의무를 부과하는 조항으로, 2027년 1월 1일부터 국내 서비스에 적용된다. AI 기능을 탑재한 앱·플랫폼을 운영하는 스타트업과 크리에이터 툴 개발사가 직접적인 영향권에 들어온다.

4분ai-policyregulation

Anthropic, Claude Haiku 4.5 함수 호출 성능 대폭 강화—경량 에이전트 실전 투입 가속

Anthropic이 Claude Haiku 4.5의 함수 호출(Function Calling) 정확도와 병렬 도구 실행 안정성을 대폭 개선한 업데이트를 공식 배포했다. 낮은 레이턴시와 저비용이 강점인 Haiku 4.5가 멀티스텝 에이전트 루프에서도 실용적 수준에 도달함에 따라, 고비용 모델 없이 경량 에이전트 파이프라인을 구성하려는 한국 개발자들에게 직접적인 선택지가 생겼다.

4분anthropicfunction-calling
2026-07-07·3
2026-07-06·3
2026-07-05·2
2026-07-04·3
2026-07-03·1
2026-07-02·3

Anthropic, Claude Haiku 4.5 토큰 효율 벤치마크 공개—경량 에이전트 최적 선택지 부상

Anthropic이 Claude Haiku 4.5의 공식 성능 벤치마크와 함께 경량 에이전트 워크플로우 최적화 가이드를 공개했다. 반복 호출이 많은 분류·라우팅·요약 태스크에서 Sonnet 4.6 대비 응답 속도가 최대 2.4배 빠르고 비용이 낮아, 고빈도 자동화 파이프라인 설계 시 모델 선택 기준이 명확해졌다.

4분anthropicclaude

Meta, Llama 4 Maverick 한국어 파인튜닝 공식 레시피 공개

Meta가 Llama 4 Maverick 17B(활성 파라미터 기준) 모델의 한국어 도메인 특화 파인튜닝을 위한 공식 가이드와 샘플 데이터셋 구성 지침을 Llama 공식 리포지터리에 추가했다. LoRA 랭크 64 기준 A100 80GB 단일 GPU로 8시간 내 수렴 가능한 하이퍼파라미터 세트를 제공해, 국내 스타트업과 개인 개발자의 진입 장벽이 낮아질 전망이다.

5분metallama

Google, Gemini Flash 2.5 배치 API 정식 GA—대규모 문서 처리 비용 50% 절감

Google DeepMind가 Gemini Flash 2.5 모델을 대상으로 Batch API를 정식 출시하며, 실시간 응답이 불필요한 대량 작업에 한해 표준 API 대비 최대 50% 할인된 요금을 적용한다. 비동기 큐 방식으로 최대 24시간 내 결과를 반환하며, 수천 개 문서 요약·분류·임베딩 생성 등 배치성 파이프라인에 즉시 활용 가능하다. 크리에이터·개발자 모두 운영 비용을 크게 낮출 수 있어 프로덕션 도입 장벽이 실질적으로 낮아졌다는 평가다.

4분googlegemini
2026-07-01·3
2026-06-30·3
2026-06-29·1
2026-06-28·3

Google, Gemini Code Assist Enterprise 정식 GA—IDE 무관 에이전트 리뷰 지원

Google DeepMind가 Gemini Code Assist Enterprise를 정식 출시하며 VS Code·JetBrains·Neovim 등 주요 IDE에서 에이전트 기반 PR 자동 리뷰와 취약점 탐지를 지원한다. 팀 단위 코드베이스 인덱싱을 통해 사내 컨벤션을 학습한 맞춤형 제안이 가능해졌으며, 엔터프라이즈 규모 도입 시 코드 리뷰 사이클을 평균 40% 단축한다고 밝혔다.

4분googlecode-assist

EU AI Act 고위험 AI 의무 조항 발효—한국 개발자 대응 체크리스트

EU AI Act의 고위험 AI 시스템 관련 의무 조항이 2026년 6월 28일부로 공식 적용되기 시작하며, EU 시장에 서비스를 출시하는 한국 기업·개발자도 적합성 평가와 기술 문서화 의무를 즉시 이행해야 한다. 특히 채용·신용평가·의료 보조 등 8개 분야 AI 기능을 포함한 SaaS 제품은 CE 마킹에 준하는 AI 적합성 선언서를 갖춰야 규제 리스크를 피할 수 있다.

5분eu-ai-actpolicy

Meta, Llama 4 Scout 함수 호출 API 정식 GA—온디바이스 에이전트 구축 문 열려

Meta가 Llama 4 Scout의 Function Calling API를 정식 출시하며 엣지·온디바이스 환경에서도 구조화된 도구 호출 파이프라인을 구성할 수 있게 됐다. 클라우드 의존 없이 로컬 추론 환경에서 에이전트를 운영하려는 한국 개발자에게 실질적인 대안이 생긴 셈이다.

4분metallama
2026-06-27·3

Anthropic, Claude Opus 4 Extended Thinking 정식 GA—복합 추론 태스크 성능 대폭 향상

Anthropic이 Claude Opus 4의 Extended Thinking 모드를 정식 GA로 전환하며 API를 통한 상용 사용을 전면 개방했다. 내부 사고 과정(thinking tokens)을 최대 32,000토큰까지 할당할 수 있어 복잡한 코드 아키텍처 설계, 수학적 증명, 다단계 비즈니스 로직 구현에서 기존 대비 정확도가 크게 향상됐다. 한국 개발자는 Messages API에서 `thinking` 파라미터를 활성화하는 것만으로 즉시 사용할 수 있다.

4분anthropicllm

OpenAI Codex CLI v2 정식 출시—멀티파일 편집·로컬 실행 샌드박스 지원

OpenAI가 터미널 기반 코딩 에이전트 Codex CLI의 v2를 정식 GA로 출시하며 멀티파일 동시 편집과 로컬 샌드박스 실행 환경을 공식 지원하기 시작했다. 단일 프롬프트로 여러 파일에 걸친 리팩터링과 테스트 코드 생성을 자동화할 수 있어 IDE 없이 터미널만으로 에이전트 개발 루프를 완성할 수 있다. npm 또는 pip 단일 명령으로 설치되며, 기존 OpenAI API 키를 그대로 사용한다.

4분openaideveloper-tools

Anthropic, Claude Code SDK 정식 GA—에이전트 코딩 파이프라인 직접 구축 가능

Anthropic이 Claude Code의 핵심 기능을 외부 애플리케이션에 직접 임베드할 수 있는 Claude Code SDK를 정식 출시했다. 개발자는 이제 자체 IDE, CI/CD 파이프라인, 사내 개발 도구에 코드 자율 실행·수정·테스트 루프를 통합할 수 있으며, 멀티에이전트 오케스트레이션 패턴도 공식 지원된다.

4분anthropicclaude-code
2026-06-26·3
2026-06-25·3
2026-06-24·1
2026-06-23·3
2026-06-22·3

Google DeepMind, Gemini Robotics API 정식 공개—물리 AI 시대 개막

Google DeepMind가 Gemini Robotics API를 정식 GA로 공개하며, 로봇 제어·물리 시뮬레이션·센서 융합을 단일 API로 처리할 수 있게 됐다. 한국 제조·물류 스타트업이 자체 하드웨어 없이도 클라우드 기반 로봇 지능을 프로토타이핑할 수 있어 진입 장벽이 크게 낮아질 전망이다.

4분google-deepmindrobotics

Meta, Llama 4 Maverick 한국어 코딩 벤치마크 공개—오픈소스 최초 GPT-4o 수준

Meta가 Llama 4 Maverick의 한국어 특화 코딩·추론 벤치마크 결과를 공식 발표하며, 오픈소스 모델 최초로 HumanEval-KO 및 KoBigBench에서 GPT-4o와 동급 점수를 기록했다고 밝혔다. 로컬 또는 자체 서버에 배포 가능한 오픈 가중치 모델이 한국어 코드 생성에서 상용 API를 대체할 수 있다는 점에서 비용·보안 민감 프로젝트에 실질적 선택지가 생겼다.

5분metallama

GitHub Copilot, 에이전트 모드 VS Code 정식 GA—자율 태스크 실행 지원

GitHub Copilot의 에이전트 모드(Agent Mode)가 VS Code에서 정식 출시되어, 단순 코드 제안을 넘어 파일 생성·터미널 명령 실행·오류 자동 수정까지 자율적으로 처리한다. 개발자는 자연어로 목표만 지정하면 Copilot이 다단계 작업을 스스로 계획하고 실행하며, Copilot Business·Enterprise 플랜 구독자는 추가 비용 없이 즉시 사용 가능하다.

4분copilotvscode
2026-06-21·2
2026-06-20·3

Anthropic, Claude Opus 4 시스템 프롬프트 캐싱 정식 지원—긴 컨텍스트 반복 호출 최적화

Anthropic이 Claude Opus 4 모델에 대해 최대 200K 토큰 범위의 시스템 프롬프트 캐싱을 정식 지원하기 시작했다. 대형 코드베이스나 문서를 반복적으로 참조하는 에이전트 워크플로에서 입력 토큰 비용을 최대 90%까지 절감할 수 있어, 장문 컨텍스트를 활용하는 한국 개발자에게 실질적인 운영 비용 개선이 기대된다.

4분anthropicclaude

OpenAI, Codex 클라우드 샌드박스 정식 GA—격리 환경서 코드 자율 실행

OpenAI가 Codex 에이전트가 클라우드 격리 샌드박스 내에서 코드를 직접 작성·실행·테스트·수정하는 전 과정을 자율 수행하는 Codex 클라우드 샌드박스를 정식 GA(General Availability)로 전환했다. 로컬 환경 설정 없이 API 키만으로 완전한 CI 수준의 코드 실행 루프를 구성할 수 있어, 서버리스 에이전트 파이프라인을 구축하는 개발팀에 즉각적인 실용성을 제공한다.

4분openaicodex

Anthropic, Claude Code SDK 정식 GA—에이전트 워크플로 직접 빌드 가능

Anthropic이 Claude Code의 핵심 에이전트 기능을 외부 애플리케이션에 직접 내장할 수 있는 Claude Code SDK를 정식 출시했다. 개발자는 파일 읽기·쓰기, 터미널 실행, 웹 검색 등 내장 도구를 자신의 파이프라인에 그대로 활용하거나 커스텀 툴을 추가해 독자적인 코딩 에이전트를 구성할 수 있다. 기존 CLI 단독 사용 대비 자동화 통합 범위가 크게 확장되어 CI/CD, 사내 개발 포털, 코드 리뷰 봇 등 다양한 B2B 시나리오에 적용이 가능해졌다.

4분anthropicclaude-code
2026-06-19·3

Cursor 0.50, 멀티 파일 에이전트 모드 정식 출시

Cursor가 0.50 버전에서 멀티 파일 동시 편집과 터미널 자동 실행을 결합한 에이전트 모드를 정식 GA로 전환했다. 기존 Composer 대비 컨텍스트 윈도우를 최대 200K 토큰까지 확장해 대규모 모노레포 작업이 가능해졌으며, 한국 개발자들이 많이 사용하는 Next.js·NestJS 프로젝트 템플릿도 공식 지원 목록에 추가됐다.

4분cursoragent

Claude Code, 병렬 서브에이전트 실행 기능 베타 공개

Anthropic이 Claude Code에 복수의 서브에이전트를 동시에 스폰(spawn)해 독립 작업을 병렬 처리하는 기능을 베타로 공개했다. 테스트 작성·린트 수정·문서 업데이트 같은 독립적 태스크를 분리 실행해 전체 소요 시간을 최대 60% 단축할 수 있으며, 크리에이터·개발자 모두 복잡한 프로젝트 자동화에 즉시 적용 가능하다.

4분claude-codeanthropic

Anthropic, Claude Haiku 4.5 배치 API 정식 GA—대량 처리 비용 50% 추가 절감

Anthropic이 Claude Haiku 4.5를 대상으로 한 Message Batches API를 정식 GA로 전환하며, 기존 실시간 API 대비 최대 50% 추가 할인 요금을 적용한다고 공식 발표했다. 비동기 대량 요청 처리가 필요한 데이터 파이프라인·콘텐츠 자동화 워크플로에서 운영 비용을 대폭 낮출 수 있어 한국 개발자·크리에이터에게 실질적인 영향을 준다.

4분anthropicapi
2026-06-18·3

OpenAI Codex CLI 정식 GA—터미널에서 자연어로 코드 실행

OpenAI가 터미널 전용 코딩 에이전트 Codex CLI를 정식 출시했다. 로컬 파일시스템을 직접 읽고 수정하며, 샌드박스 모드와 자동 승인 모드를 분리 제공해 안전성과 생산성을 동시에 확보했다. 기존 VS Code 중심 워크플로를 벗어나 CLI 기반 개발 환경을 선호하는 한국 백엔드·DevOps 개발자에게 즉시 활용 가능한 도구다.

4분openaicli

Hugging Face, 서드파티 추론 프로바이더 통합 API 정식 공개

Hugging Face가 단일 API 엔드포인트로 Together AI·Fireworks AI·Nebius 등 외부 추론 인프라를 호출할 수 있는 Inference Providers 기능을 정식 공개했다. 모델 허브에서 프로바이더를 선택하면 동일한 `InferenceClient` 코드로 공급사를 전환할 수 있어 벤더 종속 리스크가 줄어든다. 오픈소스 모델을 프로덕션에 투입하는 한국 스타트업과 크리에이터 툴 개발자에게 멀티 클라우드 전략의 실용적 출발점이 된다.

5분huggingfaceopen-source

Google, Gemini 2.5 Flash-Lite 정식 GA—저비용 고속 추론 API 공개

Google DeepMind가 Gemini 2.5 Flash-Lite를 Google AI Studio 및 Vertex AI에서 정식 GA로 전환했다. 기존 Gemini 2.5 Flash 대비 입출력 토큰 단가를 최대 50% 낮추면서 응답 지연은 유사하게 유지해, 대량 배치 처리나 비용 민감형 프로덕션 파이프라인에 실질적인 대안이 생겼다.

4분googlegemini
2026-06-17·3
2026-06-16·3
2026-06-15·3
2026-06-14·3

Anthropic, Claude Opus 4 확장 사고 API 정식 공개—복잡한 추론 태스크 직접 통합

Anthropic이 Claude Opus 4의 확장 사고(Extended Thinking) 기능을 Messages API를 통해 정식으로 외부 개발자에게 공개했다. 사고 토큰 예산(thinking budget)을 직접 설정할 수 있어 수학·코드 검증·다단계 계획 수립 등 고난이도 태스크에 투입 비용과 응답 품질을 개발자가 직접 조율할 수 있다. 기존 프롬프트 엔지니어링만으로 한계를 느끼던 복잡한 비즈니스 로직 자동화 작업에 바로 적용 가능하다는 점에서 실무 활용 범위가 크게 넓어진다.

4분anthropicllm

Meta, Llama 4 Scout 멀티모달 파인튜닝 레시피 공식 공개—이미지+텍스트 커스텀 모델 구축 가능

Meta가 Llama 4 Scout(17B 활성 파라미터, MoE 구조)에 대한 멀티모달 지도 파인튜닝(SFT) 레시피와 예제 데이터셋을 공식 GitHub 리포지터리에 공개했다. 텍스트 전용 파인튜닝과 달리 이미지-텍스트 쌍 데이터를 활용해 도메인 특화 시각 이해 모델을 누구나 직접 학습시킬 수 있게 됐다. 클라우드 GPU 비용을 최소화하는 LoRA 기반 학습 스크립트도 함께 제공되어 스타트업과 1인 개발자도 실질적으로 활용 가능한 수준이다.

5분metaopen-source

OpenAI, GPT-4o 비전 파인튜닝 정식 GA—이미지 입력 커스텀 모델 API 공개

OpenAI가 GPT-4o의 이미지 입력을 포함한 멀티모달 파인튜닝을 정식 지원하며, 개발자는 이제 텍스트와 이미지를 혼합한 학습 데이터로 도메인 특화 비전 모델을 직접 훈련할 수 있다. 기존 텍스트 전용 파인튜닝 대비 UI 검수·의료 이미지·제조 결함 탐지 등 실무 적용 범위가 크게 확장되어, 반복적인 프롬프트 엔지니어링 없이 일관된 비전 추론 결과를 얻을 수 있다.

4분openaifine-tuning
2026-06-13·3
2026-06-12·3

OpenAI Codex CLI 정식 GA—터미널에서 코드 자율 실행

OpenAI가 터미널 기반 코딩 에이전트 Codex CLI를 정식 GA로 전환하며 GPT-4.1 모델과의 통합을 강화했다. 파일 읽기·쓰기·명령 실행을 샌드박스 없이 로컬에서 수행할 수 있어 한국 백엔드·DevOps 개발자의 일상 워크플로에 직접 연결된다. npm 또는 pip 단일 명령으로 설치 가능하며, 요금은 GPT-4.1 API 종량제를 그대로 적용한다.

4분openaicli

Anthropic, Tool Use 스트리밍 응답 정식 지원—에이전트 UX 대폭 개선

Anthropic이 Claude API의 Tool Use(함수 호출) 결과를 스트리밍으로 반환하는 기능을 정식 지원하기 시작했다. 기존에는 도구 실행 완료 후 전체 응답을 한 번에 받아야 했으나, 이제 중간 추론 텍스트와 도구 입력 파라미터가 실시간으로 델타 스트림으로 전달된다. 응답 대기 시간이 체감상 크게 줄어 챗봇·코딩 에이전트 등 인터랙티브 서비스의 사용자 경험이 개선된다.

4분anthropicapi

Anthropic, Claude Haiku 4.5 배치 API 정식 GA—대용량 비동기 처리 비용 최대 50% 절감

Anthropic이 Claude Haiku 4.5를 대상으로 한 Message Batches API를 정식 GA로 전환하며, 최대 10만 건의 요청을 단일 배치로 비동기 제출할 수 있게 됐다. 실시간 응답이 불필요한 데이터 가공·콘텐츠 분류·대규모 번역 파이프라인에서 표준 API 대비 최대 50% 낮은 단가를 공식 적용받는다. 한국 개발자와 크리에이터가 야간 배치 작업이나 대량 텍스트 처리 워크플로를 구성할 때 즉시 활용 가능하다.

4분anthropicapi
2026-06-11·3
2026-06-10·3

OpenAI, Realtime API WebRTC 모드 정식 GA—브라우저 직접 음성 통화 구현

OpenAI가 Realtime API의 WebRTC 전송 방식을 정식 GA로 전환했다. 기존 WebSocket 방식 대비 서버 중계 없이 브라우저와 모델 간 직접 저지연 음성 스트림이 가능해져, 별도 백엔드 없이 클라이언트 단에서 실시간 음성 대화 앱을 구현할 수 있다. 한국 크리에이터·스타트업의 음성 인터페이스 프로토타입 비용과 인프라 복잡도가 대폭 줄어들 전망이다.

4분openairealtime

Meta Llama 4 Maverick GGUF 공식 배포—Ollama·llama.cpp 즉시 로컬 실행

Meta가 Llama 4 Maverick 모델의 GGUF 포맷 공식 가중치를 Hugging Face에 공개했다. Q4_K_M 양자화 기준 약 24GB로, RTX 4090 단일 GPU 또는 M2 Max MacBook Pro에서 추론이 가능하다. Ollama와 llama.cpp 최신 버전에서 즉시 `ollama pull llama4:maverick` 한 줄로 실행할 수 있어 국내 로컬 AI 개발 환경이 한 단계 넓어질 것으로 보인다.

4분metallama

Google DeepMind, Veo 3 동영상 생성 API 정식 GA—크리에이터 워크플로 직접 통합 가능

Google DeepMind가 Veo 3 동영상 생성 모델의 API를 Vertex AI를 통해 정식 공개했다. 텍스트·이미지 프롬프트로 최대 1080p, 60fps 동영상을 프로그래밍 방식으로 생성할 수 있어, 콘텐츠 제작 파이프라인 자동화가 현실화됐다. 한국 크리에이터와 미디어 스타트업이 자체 서비스에 고품질 동영상 생성 기능을 직접 내재화할 수 있는 첫 번째 공식 경로다.

4분google-deepmindvideo-generation
2026-06-09·3

GitHub Copilot, 에이전트 모드 VS Code 정식 GA—멀티파일 자율 편집 지원

GitHub Copilot의 에이전트 모드가 VS Code에서 정식 출시되어, 단일 프롬프트로 여러 파일을 자율적으로 생성·수정·삭제하는 작업이 가능해졌다. 터미널 명령 실행 및 테스트 자동 수정 루프까지 포함되어 기존 인라인 제안 방식과 차별화된다.

3분copilotdeveloper-tools

EU AI법 범용 AI 실천 강령 최종안 확정—한국 기업 대응 체크리스트

유럽연합이 AI법(AI Act)의 범용 AI(GPAI) 모델 적용 조항에 대한 실천 강령(Code of Practice) 최종안을 확정 공고했다. 연간 활성 사용자 1000만 명 이상 또는 학습 연산량 10²⁵ FLOP 초과 모델에 대해 투명성 보고서 및 저작권 학습 데이터 로그 제출이 의무화된다. 한국 기업도 EU 시장에 AI 서비스를 제공할 경우 2026년 8월부터 적용 대상이 된다.

4분ai-policyregulation

Google DeepMind, Gemma 3 27B 함수 호출 공식 지원—온프레미스 에이전트 구축 가능

Google DeepMind가 오픈소스 모델 Gemma 3 27B에 함수 호출(Function Calling) 기능을 정식 탑재하고 Hugging Face 및 Kaggle을 통해 업데이트된 가중치를 배포했다. 이로써 개발자는 외부 API 호출이나 로컬 툴 실행을 클라우드 의존 없이 자체 인프라에서 구현할 수 있어, 데이터 외부 유출을 꺼리는 기업 환경에서의 에이전트 파이프라인 구축 비용이 크게 낮아진다.

4분google-deepmindopen-source
2026-06-08·3
2026-06-07·2
2026-05-02·3
2026-05-01·3
2026-04-30·3
2026-04-29·3
2026-04-28·2
2026-04-27·2
2026-04-26·2
2026-04-25·2
2026-04-18·3
2026-04-17·1
2026-04-16·1
2026-04-15·1
2026-04-14·1
2026-04-13·1
2026-04-12·1
2026-04-11·1