k
korAI
AI 뉴스 전체
📰 AI 뉴스2026-09-084분

Anthropic, Claude Sonnet 4.6 확장 사고 모드 정식 GA — 토큰 예산 제어 API 공개

Anthropic이 Claude Sonnet 4.6의 확장 사고(Extended Thinking) 모드를 정식 GA로 전환하고, 개발자가 추론 토큰 예산을 세밀하게 제어할 수 있는 `thinking` 파라미터 API를 공개했다. 기존 베타 대비 최대 사고 토큰 한도가 32,000토큰으로 확대되어 복잡한 수학·코드 디버깅 태스크에서 체감 정확도가 향상됐다. 한국 개발자는 API 키 재발급 없이 즉시 적용 가능하며, 추론 토큰 과금 구조는 공식 페이지를 참조해야 한다.

anthropicllmapi

확장 사고 모드란 무엇인가

Claude Sonnet 4.6의 확장 사고 모드는 모델이 최종 응답을 생성하기 전에 내부적으로 단계별 추론 과정을 수행하도록 강제하는 기능이다. 기존 일반 추론과 달리, 이 모드에서는 thinking 블록이 스트리밍 응답에 포함되어 개발자가 모델의 중간 사고 흐름을 실시간으로 파악할 수 있다.

{
  "model": "claude-sonnet-4-6",
  "max_tokens": 16000,
  "thinking": {
    "type": "enabled",
    "budget_tokens": 10000
  },
  "messages": [{"role": "user", "content": "..."}]
}

budget_tokens 값은 1,024 이상으로 설정해야 하며, 이번 GA에서 최대 32,000토큰까지 지원이 확대됐다.

개발자·크리에이터에게 실질적으로 달라지는 점

| 항목 | 베타 | GA (2026-09-08) | |---|---|---| | 최대 사고 토큰 | 16,000 | 32,000 | | 스트리밍 지원 | 부분 | 전체 | | 함수 호출(Tool Use) 병행 | 미지원 | 지원 | | 한국어 사고 블록 품질 | 제한적 | 개선 |

특히 Tool Use와 Extended Thinking 동시 사용이 가능해져, 복잡한 멀티스텝 에이전트 파이프라인에서 추론 신뢰도를 높이면서도 외부 API 호출을 결합할 수 있다. 콘텐츠 제작 도구를 개발하는 크리에이터 팀이라면 긴 스크립트 구조 분석이나 다단계 편집 플랜 생성에 즉시 활용 가능하다.

비용 및 적용 시 주의사항

사고 토큰은 출력 토큰과 별도로 과금되므로, budget_tokens를 무분별하게 높이면 비용이 급증할 수 있다. Anthropic은 태스크 복잡도에 따라 1,024~8,000 범위를 권장하며, 단순 Q&A나 요약 태스크에는 일반 모드 사용을 명시적으로 권고했다. 정확한 토큰당 단가는 공식 페이지를 참조해야 하며, AWS Bedrock·Google Cloud Vertex AI를 통한 접근 시 과금 체계가 상이할 수 있다. 현재 Claude Opus 4.7에는 확장 사고가 이미 적용되어 있으며, Haiku 4.5는 이번 GA 범위에 포함되지 않는다.

출처: Anthropic Documentation