오픈AI가 세레브라스 반도체 기반의 신규 추론 모드 '울트라패스트' 프리뷰를 출시했다. GPT-5.6 솔 모델에서 초당 최대 750토큰의 출력 속도를 내며, 100억 달러 규모의 세레브라스 파트너십을 통해 구현됐다. 초기에는 API를 통해 일부 고객에게만 제한 제공되며, 점차 접근 범위를 넓힐 계획이다. 오픈AI는 장애 대응, 금융 이상거래 탐지, 실시간 고객 상담, 전자상거래 추천 등에서 즉각적인 활용 사례를 제시했다. 기존 '패스트모드'(2.5배 속도, 2배 가격)에 이어 울트라패스트를 세 번째 유료 등급으로 추가하며, 추론 속도 자체를 수익화하는 전략을 강화하고 있다.
- •오픈AI가 세레브라스 하드웨어 기반 신규 추론 모드 '울트라패스트'를 프리뷰로 출시했다.
- •GPT-5.6 솔 기준 초당 최대 750토큰 출력 속도를 낸다.
- •초기에는 API를 통해 일부 고객에게만 제한적으로 제공된다.
- •장애 대응, 금융 이상거래 탐지, 실시간 고객 상담 등 즉시성이 중요한 업무에 활용 가능하다.
- •기존 패스트모드(2.5배 속도)에 이은 세 번째 유료 속도 등급으로, 추론 속도를 수익화하는 전략이다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
GPT-5.6 Sol goes 14x faster as OpenAI launches Ultrafast mode powered by Cerebras
- 1.OpenAI, 세레브러스와 제휴해 'Ultrafast' 모드 프리뷰 출시, GPT-5.6 Sol을 초당 750토큰 속도로 제공
- 2.세레브러스는 올해 초 OpenAI와 100억달러 규모 파트너십 체결, 서비스는 우선 API를 통해 일부 고객에만 제공
- 3.장애 대응·금융 이상거래 탐지·고객응대·이커머스 등 실시간성이 중요한 사용사례 제시, 사내 장애응대에 이미 사용 중
- 4.기존 Fast Mode(2.5배 속도, 약 2배 가격)에 이어 Ultrafast를 3번째 요금제로 추가해 추론 속도를 과금화
왜 중요한가?
추론 속도를 티어별 요금제로 상품화하는 전략은 AWS식 클라우드 성능 과금 모델을 AI 추론에 그대로 적용한 것으로, 속도가 산업 전반의 병목이 될수록 OpenAI가 이 가치 상승분을 직접 수익화할 수 있는 구조를 만든다.
언급 프로젝트
본문 미리보기
OpenAI is launching "Ultrafast," a new inference mode that delivers GPT-5.6 Sol at up to 750 output tokens per second, powered by Cerebras hardware from their $10 billion partnership. Together with "Standard" and "Fast," Ultrafast creates a three-tier pricing structure that turns inference speed into its own product. The article GPT-5.6 Sol goes 14x faster as OpenAI launches Ultrafast mode powered by Cerebras appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:17AI 초안

