알리바바 큐원팀이 8월26일 Qwen4 아키텍처를 미리 보여주는 오픈웨이트 실험 모델 'Qwen3.8-Flash-Next'를 공개했다. 이 모델은 총 1250억 파라미터를 갖췄지만 토큰당 60억개만 활성화하는 구조로, 팀은 이를 '궁극의 비용 효율성'을 향한 단계로 설명한다. 이번 공개는 해당 설계를 기반으로 한 첫 공개 모델이라는 점에서 의미가 있다.
- •알리바바 큐원팀, 8월26일 Qwen4 아키텍처 프리뷰 모델 'Qwen3.8-Flash-Next' 공개
- •총 1250억 파라미터 중 토큰당 60억개만 활성화하는 구조로 설계
- •팀은 이번 설계를 '궁극의 비용 효율성'을 향한 단계로 규정, 해당 아키텍처 기반 첫 공개 모델
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Qwen3.8-Flash-Next Previews Qwen4 Architecture With 6B Active Parameters

- 1.알리바바 Qwen팀이 8월26일 'Qwen3.8-Flash-Next'를 오픈웨이트로 공개, 총 125B 파라미터 중 토큰당 6B만 활성화
- 2.하이브리드 어텐션 구조로 차기 Qwen4 아키텍처를 미리 선보이는 실험적 모델
- 3.이 설계를 적용한 최초의 공개 모델이며, 팀은 '궁극의 비용 효율성'을 향한 단계라고 설명
왜 중요한가?
총 파라미터 대비 활성 파라미터를 6B로 낮춘 희소 아키텍처를 차기 주력 모델(Qwen4)에 앞서 실험 공개함으로써, 비용 효율을 앞세운 차세대 설계 방향을 미리 검증받으려는 시도로 볼 수 있다.
본문 미리보기
Qwen3.8-Flash-Next Previews Qwen4 Architecture With Hybrid Attention and 6B Active Parameters Alibaba's Qwen team released Qwen3.8-Flash-Next on August 26, 2026, an open-weight experimental model that previews the architecture intended to underpin Qwen4. The model carries 125B parameters but activates only 6B per token, a configuration the team frames as a step toward what it calls ultimate cost-efficiency. The release is the first public model built on this design. The Qwen3.8-Flash-Next model…
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:53AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
