세레브라스가 웨이퍼 스케일 프로세서 3개를 결합한 4세대 AI 가속기 시스템 'CS-4'를 공개하며 기존 GPU 시스템 대비 최대 30배 빠른 추론 성능을 달성했다고 밝혔다. TSMC 5나노 공정의 'WSE-3 터보' 3개를 하나의 시스템으로 묶고 전력·냉각·I/O 구조를 전면 재설계해 10조 개 이상 매개변수의 초대형 모델에서도 초당 1000토큰 이상을 처리할 수 있다. 새로운 '넥서스' 아키텍처로 웨이퍼 간 통신 지연을 약 2마이크로초로 낮추고 I/O 대역폭을 2배 늘렸으며, 전력 변환을 프로세서에 근접시켜 와트당 처리량을 전작 CS-3 대비 최대 10배 개선했다. CS-4는 3분기부터 일부 고객에 샘플 공급을 시작하며, 세레브라스는 2027년 말까지 600메가와트 규모 컴퓨팅 용량 공급을 목표로 하고 있다.
- •WSE-3 터보 프로세서 3개 결합, GPU 대비 최대 30배 빠른 추론 성능 구현
- •초대형 모델(매개변수 10조개 이상)에서도 초당 1000토큰 이상 처리 가능
- •와트당 처리량 전작 CS-3 대비 최대 10배 개선, 웨이퍼 간 통신 지연 약 2마이크로초로 단축
- •3분기 초기 공급 시작, 2027년 말까지 600MW 컴퓨팅 용량 공급 목표
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
세레브라스, 차세대 AI 가속기 'CS-4' 공개…"GPU 대비 30배 빨라"
- 1.세레브라스, 차세대 AI 가속기 'CS-4' 공개…GPU 대비 최대 30배 빠른 추론
- 2.웨이퍼 스케일 프로세서 'WSE-3 터보' 3개 결합, 초당 1000토큰 이상 처리 설계
- 3.전 세대 대비 와트당 처리량 최대 10배 개선, 통신 지연 2마이크로초로 단축
- 4.3분기 초기 공급 시작, 2027년 말까지 600MW 규모 컴퓨팅 용량 공급 목표
왜 중요한가?
AI 인프라가 응답 속도와 데이터센터 처리량 중 하나를 선택해야 했던 한계를 동시에 해결했다고 주장하는 만큼, GPU 중심 추론 시장에서 엔비디아의 대안으로 자리매김할 수 있을지가 관전 포인트다.
본문 미리보기
세레브라스가 차세대 AI 가속기 시스템 ‘CS-4’를 공개했다. 자체 개발한 웨이퍼 스케일 프로세서 3개를 하나의 시스템에 결합하고 전력·냉각·입출력(I/O) 구조까지 전면 재설계해, 기존 GPU 기반 시스템보다 최대 30배 빠른 AI 추론 성능을 구현했다. 세레브라스가 19일(현지시간) 공개한 CS-4는 4세대 AI 시스템으로, 자체 개발한 ‘웨이퍼 스케일 엔진 3 터보(WSE-3 Turbo)’ 프로세서 3개를 기반으로 한다.WSE-3 터보는 TSMC의 5나노미터(nm) 공정으로 생산되며, 세레브라스의 기존 제품처럼 일반적인 GP
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

