아마존 베드록이 오픈AI의 GPT-5.6 모델군(Sol, Terra, Luna)에 대해 25개 이상 AWS 리전에서 크로스 리전 추론을 지원한다고 발표했다. 지역 추론 프로필은 특정 지역 내에서만 요청을 라우팅해 데이터 거주 요건을 지키면서 용량을 확장할 수 있고, 글로벌 프로필은 실시간 가용 용량에 따라 전 세계 지원 리전으로 요청을 분산해 처리량을 극대화한다. 세 모델 모두 100만 토큰 컨텍스트 창과 추론 모드, 프롬프트 캐싱을 지원하며 오픈AI 리스폰스·챗 컴플리션 API와 베드록 컨버스 API로 호출할 수 있다. 아웃풋 토큰의 TPM 쿼터 소모율이 10배에 달해 아웃풋이 많은 워크로드는 사전에 쿼터 증설을 검토해야 한다.
- •GPT-5.6 3종(Sol·Terra·Luna)이 25개 이상 AWS 리전에서 크로스 리전 추론 지원
- •지역 프로필은 데이터 거주 요건 준수, 글로벌 프로필은 전 세계 용량 풀 활용
- •100만 토큰 컨텍스트, 추론 모드, 프롬프트 캐싱 지원, 오픈AI 및 베드록 API 호환
- •아웃풋 토큰 쿼터 소모율이 10배로 높아 아웃풋 중심 워크로드는 쿼터 증설 필요
- •로깅·쿼터는 소스 리전에서 관리되며 지역·글로벌 프로필별로 별도 집계
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Introducing cross-Region inference for OpenAI GPT-5.6 models on Amazon Bedrock

- 1.AWS, Bedrock에 OpenAI GPT-5.6(솔·테라·루나) 크로스리전 추론 25개+ 리전 지원
- 2.지역별(Geo) CRIS는 데이터 주권 유지, 글로벌 CRIS는 전세계 용량 풀 활용
- 3.1M 토큰 컨텍스트, 추론모드·프롬프트 캐싱 지원, 주요 API 3종 모두 호환
- 4.출력 토큰 버든다운 비율 10배 적용, TPM 쿼터는 프로필별 별도 관리
왜 중요한가?
OpenAI 모델을 Bedrock의 리전 간 용량 풀링으로 사용할 수 있게 되면서, 데이터 주권 요건과 처리량 확보를 동시에 만족시켜야 하는 기업 워크로드의 안정적 확장을 지원한다.
본문 미리보기
Amazon Bedrock now offers OpenAI GPT-5.6 models (Sol, Terra, and Luna) in more than 25 AWS Regions with cross-Region inference. Learn how US geographic and global inference profiles route requests for higher throughput, how to call the models with the OpenAI and Converse APIs, and how to configure IAM, quotas, and monitoring.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:02AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
