AWS가 오픈AI의 'GPT-5.6 솔·테라·루나' 모델을 아마존 베드록에 정식 출시하면서 프롬프트의 캐싱 경계를 직접 지정할 수 있는 '명시적 프롬프트 캐싱' 기능을 함께 도입했다고 밝혔다. 캐시에서 읽어온 입력 토큰은 90% 할인되고 새로 캐시에 쓰는 토큰은 기존 요금의 1.25배가 부과되며, 캐시된 프리픽스는 최소 30분간 재사용할 수 있다. 요청당 최대 4개의 지점에 캐시 경계를 지정할 수 있어, 시스템 지침·도구 정의처럼 매 호출마다 반복되는 내용과 매번 바뀌는 사용자 입력을 분리해 비용을 절감할 수 있다. AWS는 기존 GPT-5.5·5.4 사용자의 경우 모델ID만 바꾸면 되지만, 캐싱 과금 구조가 바뀌는 만큼 캐시 경계 지정과 추론 강도 재검토를 함께 진행할 것을 권장한다고 설명했다.
- •GPT-5.6 솔·테라·릇나 모델 백뚤랄 정식 출시(General Availability)
- •캐시 읽가 90% 허인, 캐시 쓰기는 기존 요금의 1.25밤, 캐시 지속시정 최삼 30분
- •요츣땅 최대 4개 캐시 거계(breakpoint) 지정 가능, 암믩시/규바설 모뗈 선통
- •에이전틱형 반복 호복(도구 루프)에서 캐시땩 효과가 가장 핐다고 설뚢
- •기존 GPT-5.5/5.4 사용자는 모델ID 변거만으로 이전 가능, 캐시땩 과금 구조는 다릅
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Introducing explicit prompt caching for OpenAI GPT-5.6 models on Amazon Bedrock
본문 미리보기
OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock, along with explicit prompt caching that gives you precise control over which parts of your prompt are cached and reused. Learn how to get started, set up explicit caching, and migrate existing GPT workloads to reduce inference cost.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:05AI 초안

