Superminds Test — 200만+ 에이전트가 운영되는 MoltBook 플랫폼에서 집단 지능이 자발적으로 출현하는지를 통제된 Probing Agents로 평가하는 hierarchical 프레임워크. 3계층(공동 추론·정보 합성·기본 상호작용)에서 측정. 결과는 stark — 사회가 복잡 추론에서 개별 frontier 모델을 능가하지 못하고, 분산 정보 합성도 거의 안 일어남, 사소한 조정 task도 종종 실패. 플랫폼 분석 결과 상호작용이 매우 sparse·shallow — 스레드가 단일 응답 이상으로 거의 안 늘어남. **scale만으로는 집단 지능 안 출현** — 현재 에이전트 사회의 주된 한계는 sparse·shallow 상호작용.
- •MoltBook 200만+ 에이전트 사회에서 집단 지능 자발 출현 여부를 처음 실증 평가.
- •Superminds Test — 3계층(joint reasoning·info synthesis·basic interaction) hierarchical probing.
- •결과: 사회가 frontier 개별 모델 못 능가 + 분산 정보 합성 부재 + 조정 task 빈번 실패.
- •Scale만으로 집단 지능 emergent 안 함 — sparse·shallow 상호작용이 dominant 한계.
- •에이전트 marketplace·플랫폼 설계 시 상호작용 깊이를 제도적으로 유도해야 함을 시사.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents
- 1.200만 에이전트 이상의 MoltBook 플랫폼에서 집단 지능 최초 실증 평가 수행
- 2.Superminds Test: 계층적 프레임워크로 공동 추론·정보 합성·기본 상호작용 3계층 측정
- 3.규모만으로는 집단 지능이 자동 발현되지 않음을 확인, 상호작용 희소성·업은 교류가 주요 원인
왜 중요한가?
LLM 에이전트 사회가 수백만 규모로 확장되더라도 단순 스케일링만으로는 집단 지능이 나타나지 않는다는 발견은 멀티에이전트 시스템 설계 원칙에 중요한 함의를 제공한다.
언급 프로젝트
본문 미리보기
arXiv:2604.22452v1 Announce Type: new Abstract: Collective intelligence refers to the ability of a group to achieve outcomes beyond what any individual member can accomplish alone. As large language model agents scale to populations of millions, a key question arises: Does collective intelligence emerge spontaneously from scale? We present the first empirical evaluation of this question in a large-scale autonomous agent society. Studying MoltBook, a platform hosting over two million agents, we
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:45AI 초안

