보코니 대학교에서 신입생 1,053명을 대상으로 한 무작위 실험 결과, GPT-4o를 사용한 학생들은 마케팅 과제에서 5점 만점 기준 거의 1점 가까이 높은 점수를 받았으며 아이디어 수와 논리적 일관성도 개선됐다. 인과적 추론을 다루는 짧은 수업은 전통적 채점 점수는 높이지 못했지만 학생들이 더 다양하고 독창적인 해법을 제시하도록 이끌었고, GPT-4o와 결합해도 전통 점수에는 추가 효과가 없었다. 채점 기준이 정형화된 답변에 유리해 독창성과 반증 가능성이 오히려 낮은 점수로 이어졌다는 점도 드러나, 연구진은 독창성과 사고 과정을 명시적으로 평가에 반영해야 한다고 제안했다. 다만 이번 연구는 AI 없이 실력을 확인하는 후속 시험이 없어, 성적 향상이 실제 학습으로 이어졌는지는 확인되지 않았다.
- •보코니대 신입생 1,053명 실험, GPT-4o 사용 시 5점 만점 과제 점수가 거의 1점 상승
- •인과적 추론 수업은 전통 점수는 못 높였지만 아이디어 다양성과 독창성 제고
- •채점 기준이 정형화된 답변을 선호해 독창성·반증 가능성은 오히려 감점 요인으로 작용
- •AI 사용 여부와 무관한 후속 검증 시험이 없어 실제 학습 효과는 확인되지 않음
- •연구진, 독창성과 사고 과정을 명시적으로 반영하는 채점 기준 개편 제안
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
The skills that earn top grades are the ones AI can fake best

- 1.보코니대 신입생 1,053명 실험, GPT-4o 사용 그룹이 5점 만점 과제에서 평균 1점 가까이 점수 상승
- 2.인과추론 특강은 전통 점수는 못 올렸지만 아이디어 다양성·설명력은 높여 GPT-4o와 상호보완 효과
- 3.채점 기준이 정형화된 답변을 우대해 AI 활용이 곧 '치팅 도구'가 되기 쉬운 구조적 한계 지적
- 4.AI 없이 실력을 재검증하는 후속 테스트가 없어 실제 학습 효과 여부는 확인되지 않음
왜 중요한가?
AI가 정형화된 채점 기준에 최적화된 답안을 손쉽게 만들어낼 수 있음을 실증한 연구로, 교육 현장의 평가 방식 자체를 재설계해야 한다는 논의에 근거를 제공한다.
본문 미리보기
GPT-4o boosted grades on a marketing assignment by nearly a full point on a five-point scale in an experiment with 1,053 Bocconi University students. Whether they actually learned anything wasn't tested. Other studies suggest that AI-assisted performance without independent thinking does long-term harm. The article The skills that earn top grades are the ones AI can fake best appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
