세레브라스가 차세대 AI 가속기 CS-4를 공개했다. CEO 앤드류 펠드먼은 이를 업계에서 가장 빠른 시스템이라고 소개했다. CS-4는 랙 단위 완제품으로, 기존 5nm WSE-3 칩을 그대로 쓰면서도 전력과 냉각 성능을 높여 클럭 속도를 끌어올려 전작 CS-3 대비 성능을 두 배로 높였다. 한 랙에 웨이퍼를 기존 2장에서 3장으로 늘려 사용자당 초당 최대 4,400 토큰을 처리하며, 이는 엔비디아 GPU 기반 시스템보다 최대 30배 빠르다고 회사 측은 밝혔다. 웨이퍼당 메모리 용량은 44GB로 동일하며, 모듈형 '백팩' 설계와 AMD·AWS Trainium과의 분산 추론 파트너십도 함께 도입했다. CS-4는 이미 오픈AI의 Codex Spark 등에 활용되고 있어, 추론 속도 경쟁에서 세레브라스의 입지를 강화할 것으로 보인다.
- •CS-4는 랩 단위 완제품, 기존 5nm WSE-3 칩 유지하며 전력·냉각 개선으로 CS-3 대비 성능 2배
- •랩당 웨이퍼 2장→3장으로 확대, 사용자당 초당 최대 4,400 토큰 처리(엔비디아 GPU 대비 최대 30배)
- •웨이퍼당 메모리는 44GB로 동일, 신규 모듈형 '백팩' 설계로 조립 속도 향상
- •AMD, AWS Trainium과 분산 추론(disaggregated inference) 파트너십 구축
- •오픈AI의 Codex Spark 등이 이미 세레브라스 하드웨어 사용 중
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Cerebras unveils CS-4 with double the performance on the same chip

- 1.Cerebras, 랙스케일 가속기 CS-4 공개…같은 5nm WSE-3 칩으로 CS-3 대비 성능 2배
- 2.랙 하나에 웨이퍼 3장 탑재(기존 2장), 사용자당 초당 최대 4400토큰 처리
- 3.엔비디아 GPU 대비 최대 30배 빠르다고 주장, 웨이퍼당 메모리는 44GB로 동일
- 4.모듈형 'Backpack' 설계 도입, AMD·AWS 트레이니엄과 분리형 추론 연계, 오픈AI 코덱스 스파크에 이미 사용 중
왜 중요한가?
SemiAnalysis는 네트워킹 성능 향상은 크지 않다고 평가해, Cerebras의 자체 벤치마크(엔비디아 대비 30배)와 제3자 평가 사이에 온도차가 있어 수치를 그대로 받아들이기 전 검증이 필요하다.
본문 미리보기
Cerebras has introduced its CS-4 AI accelerator, which CEO Andrew Feldman calls the fastest system in the industry. The article Cerebras unveils CS-4 with double the performance on the same chip appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
