📰 AI 뉴스2026-07-073분
OpenAI Realtime API, 한국 리전 WebRTC 엔드포인트 정식 지원
OpenAI가 Realtime API의 WebRTC 전송 계층을 한국(서울) 리전에 정식 개통해, 국내 개발자가 음성·멀티모달 스트리밍 앱을 낮은 레이턴시로 서비스할 수 있게 됐다. 기존 글로벌 단일 엔드포인트 대비 평균 왕복 지연이 약 60% 감소해 실시간 음성 에이전트 품질이 크게 향상될 전망이다.
openairealtimewebrtc
변경 사항 요약
OpenAI는 2026년 7월 7일 Realtime API의 지역 분산 WebRTC 인프라를 정식 출시하며 한국(서울) 리전을 첫 아시아-태평양 거점으로 선정했다. 기존에는 모든 WebRTC 세션이 미국 서부 단일 엔드포인트를 거쳐야 해 국내 사용자 기준 평균 RTT가 180~220ms 수준이었으나, 서울 리전 개통 후 측정값은 70~90ms로 낮아졌다.
연결 방법은 model 파라미터에 리전 힌트를 추가하는 방식으로 변경된다.
const pc = await openai.realtime.createSession({
model: "gpt-4o-realtime-preview",
region: "ap-northeast-2", // 서울 리전
voice: "alloy"
});
리전 미지정 시 클라이언트 IP 기반 자동 라우팅이 적용되며, 한국 IP는 기본적으로 서울로 유도된다.
요금 및 스펙
| 항목 | 수치 | |------|------| | 오디오 입력 | 공식 페이지 참조 | | 오디오 출력 | 공식 페이지 참조 | | 최대 세션 시간 | 30분 | | 동시 연결 (기본 티어) | 100세션 |
리전 프리미엄 추가 요금은 없으며 기존 글로벌 단가와 동일하다고 OpenAI가 밝혔다.
크리에이터·개발자 활용 시나리오
- 실시간 AI 튜터: 한국어 발음 교정, 코딩 인터뷰 연습 앱에서 응답 지연이 체감 수준 이하로 내려가 자연스러운 대화 흐름 유지가 가능하다.
- 라이브 스트리밍 연동: 방송 플랫폼 크리에이터가 실시간 시청자 Q&A를 AI로 처리할 때 자막 싱크 오류가 줄어든다.
- Next.js + Vercel 배포: Vercel 서울 엣지 리전과 조합하면 클라이언트-엣지-OpenAI 전 구간을 국내 인프라로 단축할 수 있다.
출처: OpenAI 공식 블로그