프린스턴대와 영국 AI안전연구소가 공동 진행한 연구에서 클로드 오퍼스 4.8과 GPT-5.6 솔을 사용한 AI 에이전트에게 6일, API 크레딧 3000달러, GPU 접근권을 주고 독자적으로 AI 연구 논문을 작성하게 했다. 미공개 NeurIPS 논문의 원저자들이 결과물을 심사한 결과 모두 '거절(Reject)' 판정을 내렸다. 연구에 따르면 최상위 모델들은 연구 엔지니어링 전 과정은 수행할 수 있었지만 연구적 판단력, 창의적 문제 해결, 실패한 접근법을 포기하는 능력에서는 부족했다. 이는 자율적 AI 연구가 임박했다는 앤트로픽·오픈AI의 주장과 배치되는 결과다.
- •프린스턴·영국 AI안전연구소 공동 연구, 클로드 오퍼스 4.8·GPT-5.6 솔 활용
- •AI 에이전트에 6일·API크레딧 3000달러·GPU 제공해 독자적 연구논문 작성 지시
- •미공개 NeurIPS 논문 원저자들이 결과물 심사, 전부 '거절' 판정
- •연구 엔지니어링은 가능하나 연구적 판단·창의적 문제해결은 미치
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Study contradicts Anthropic and OpenAI claims that autonomous AI research is within reach

- 1.프린스턴·영국 AI안전연구소 공동연구, 클로드 Opus 4.8·GPT-5.6 Sol에 6일·$3000·GPU를 주고 독자 연구논문 작성 지시
- 2.NeurIPS 미게재 논문 원저자들이 AI가 작성한 논문을 평가한 결과 모두 '거절(Reject)' 판정
- 3.최첨단 모델은 연구 엔지니어링 과정 수행은 가능하지만 연구적 판단력·창의적 문제해결에서는 미치지 못함
- 4.이 결과는 자율적 AI 연구가 머지않았다는 앱트로픽·OpenAI의 주장과 배치된다
왜 중요한가?
앤트로픽·OpenAI 등이 자율 AI 연구가 임박했다고 주장해온 것과 달리, 독립 연구팀의 실험은 최상위 모델도 연구 엔지니어링은 수행하되 좋은 연구 아이디어를 판단하고 막다른 접근을 포기하는 핵심 연구 역량에서는 여전히 부족함을 보여준다.
언급 프로젝트
본문 미리보기
AI agents using Claude Opus 4.8 and GPT-5.6 Sol were given six days, $3,000 in API credits, and GPU access to independently write AI research papers. The original authors of unpublished NeurIPS papers rated the results as "Reject." According to the study, conducted with Princeton and the UK AI Security Institute, frontier models can handle the full research engineering process but fall short on research judgment, creative problem-solving, and the ability to abandon failed approaches. The article
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:17AI 초안

