OpenAI가 핫칩스(Hot Chips) 콘퍼런스에서 자체 추론 전용 칩 '할라피뇨(Jalapeño)'의 첫 벤치마크 결과를 공개했다. 세미애널리시스의 인퍼런스X(InferenceX) 벤치마크에서 엔비디아 블랙웰 시스템 대비 사용자당 토큰 처리량과 킬로와트당 처리량 모두 앞섰다고 밝혔다. OpenAI 하드웨어 총괄 리처드 호는 "기존 최첨단 대비 매우 유의미한 성능 향상"이라고 평가했으며, 지난해 10월 브로드컴과 공동 개발을 발표한 이 칩은 2026년 말 소량 배포를 시작해 2027년 본격 확대될 예정이다.
- •OpenAI 추론칩 '할라피릀', 인퍼런스X 벤치마크서 엔비디아 블랙웰 대비 우위 입증
- •사용자당 토큰수·킬로와트당 처리량 모두 기존 최고 수준 상회
- •브로드컴과 공동 개발, 프리필·통신 단계 지연 최소화가 설계 핵심
- •2026년 말 소량 배포 시작, 2027년 본격 확대 예정
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show
- 1.오픈AI, 핫칩스 컨퍼런스에서 자체 추론칩 '할라페놀' 첫 벤치마크 공개 — 세미애널리시스 InferenceX 테스트
- 2.엔비디아 블랙웰 시스템 대비 사용자당 토큰수·키로와트당 처리량 모두 앞서(오픈AI 측정)
- 3.브로드컴과 공동개발, 오픈AI 자체 모델이 설계과정에 참여, 2026년말 소량 배포·2027년 본격 배포 목표
- 4.프리필·통신 단계 지연을 줄이도록 설계해 KV캐시 등 모델 상태를 로컬에 유지
왜 중요한가?
오픈AI가 엔비디아 의존을 줄이고 자체 풀스택(모델-칩-메모리) 통합 전략을 구체화하는 신호로, 실제 벤치마크가 공개되며 추론 하드웨어 경쟁이 검증 가능한 단계로 들어섰다는 의미가 있다.
본문 미리보기
Tested on SemiAnalysis’ InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently available state-of-the art.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:53AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
