세레브라스 시스템즈가 차세대 랙 스케일 AI 가속기 'CS-4'를 공개했다. CS-4는 전작 CS-3 대비 최대 2배 빠른 성능과 와트당 처리량 10배 향상을 달성했으며, GPU 기반 솔루션 대비 사용자당 초당 토큰 처리량(TPS/user)에서 최대 30배 빠른 것으로 나타났다. GPT-OSS-120B 테스트에서 사용자당 초당 4,400토큰 이상을 기록했으며, 핵심 부품인 웨이퍼 스케일 프로세서 'WSE-3 터보' 3개를 하나의 시스템으로 구성해 시스템 전체 연산 성능 750 페타플롭스, 메모리 대역폭 129.6PB/s를 구현했다. 새로운 '넥서스' 아키텍처와 '웨이퍼 스케일 백팩' 설계로 부품 수를 50% 줄이고 배포 시간을 수일에서 수시간으로 단축했으며, 2026년 3분기부터 첫 출하를 시작할 예정이다.
- •CS-4, CS-3 대비 최대 2배 성능·와트당 처리량 10배, GPU 대비 TPS/user 최대 30배
- •GPT-OSS-120B 테스트서 사용자당 초당 4,400토큰 이상 기록
- •WSE-3 터보 3개로 시스템 구성, 총 750 페타플롭스·메모리 대역폭 129.6PB/s
- •웨이퍼 스케일 백팬 설계로 부품 수 50% 감소, 배포 시간 수일→수시간 단축
- •50조 개 이상 파라미터 모델 지원, 2026년 3분기 첫 출하 예정
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
세레브라스, 혁신적인 AI 가속기 ‘CS-4’ 공개… GPU 대비 최대 30배 빠른 추론 속도
- 1.세레브라스, 차세대 AI 가속기 'CS-4' 공개…CS-3 대비 최대 2배 성능, GPU 대비 추론 최대 30배
- 2.GPT-OSS-120B 테스트서 사용자당 초당 4,400토큰 이상 기록, 와트당 처리량은 CS-3 대비 최대 10배
- 3.WSE-3 터보 3개로 750PFLOPS 랙 시스템 구성, 50조 파라미터급 모델까지 지원
- 4.'웨이퍼 스케일 백팩' 구조로 부품 수 50% 절감, 2026년 3분기 첫 출하 예정
왜 중요한가?
GPU 중심 AI 추론 인프라 시장에서 웨이퍼 스케일 프로세서가 속도·전력 효율 모두에서 큰 격차를 제시하며, AI 에이전트처럼 응답 지연이 중요한 워크로드의 인프라 선택지를 넓히고 있다.
본문 미리보기
초대형 인공지능(AI) 반도체 설계 전문 기업 세레브라스 시스템즈(Cerebras System)가 지난 5월 14일, 미국 나스닥 상장 이후 18일(현지시간), 차세대 랙 스케일 AI 가속기 ‘CS-4’를 공개했다. 이 혁신적인 가속기는 새로운 웨이퍼 스케일 엔진과 랙 및 시스템 설계를 결합해 AI 추론 성능과 전력 효율, 대규모 모델 확장성을 동시에 강화했다고 밝혔다.회사 측에 따르면 CS-4는 이전 세대인 CS-3보다 최대 2배 빠른 성능을 제공하며, GPU 기반 솔루션과 비교하면 사용자당 초당 토큰 처리량(TPS/user)에서
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:56AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
