인재채용 플랫폼 머코(Mercor) 연구에 따르면, 평균 5.5년 경력의 공인회계사(CPA) 12명과 AI 모델들에게 APEX 회계 벤치마크의 단순화된 과제를 풀게 한 결과 AI가 속도와 정확도 모두에서 회계사를 앞질렀다. 18개월 전만 해도 최고 성능 모델조차 회계사 평균 정답률(약 37%) 이하였지만, 지금은 거의 완벽하게 문제를 풀어낸다. 10개 가상 기업에 걸친 160개 과제로 구성된 전체 APEX 벤치마크에서는 클로드 오퍼스 5.5가 채점기준 61.8% 충족으로 1위, Fable 5.1이 61.0%, GPT-6 아스트라가 57.9%로 뒤를 이었다. 다만 어느 모델도 전체 과제의 약 60%를 완전히 풀어내지 못했고, 머코는 고객 상담이나 동료와의 협의, 수년간 쌓인 맥락 활용 등은 연구에서 다루지 않았다며 AI가 회계사를 대체하기보다는 업계 전반의 생산성을 크게 끌어올릴 것으로 내다봤다.
- •평균 5.5년 경력 CPA 12명 vs AI 모델, 단순화된 회계 과제에서 AI가 속도·정확도 모두 앞서
- •18개월 전 최고 모델도 CPA 평균 정답률(약 37%) 이하였으나 현재는 거의 완벽하게 과제 해결
- •전체 APEX 벤치마크(160개 과제)에서 클로드 오퍼스 5.5 61.8%로 1위, Fable 5.1·GPT-6 아스트라 순
- •고객 상담·동료 협의·누적 경험 등은 연구 범위 밖, 머코는 회계사 대체보다 생산성 향상을 전망
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
AI beats licensed accountants on speed and accuracy, but still can't close the books without supervision

- 1.Mercor 연구, AI가 공인회계사(CPA) 대비 구조화된 회계 업무서 속도·정확도 모두 압도
- 2.18개월 전 최고 모델 정확도는 CPA 평균(37%)보다 낮았으나 현재는 거의 완벽 수준
- 3.APEX 회계 벤치마크(160개 과제)서 Claude Opus 5.5 61.8%로 1위, Fable 5.1·GPT-6 Astra 뒤이어
- 4.모델 전부 과제의 약 60%는 완전히 풀지 못해, 감독 없이 결산 마감은 아직 불가능
왜 중요한가?
구조화된 반복 업무에서는 AI가 이미 숙련 회계사를 능가했지만 고객 소통·동료 협업·축적된 맥락 판단은 벤치마크 밖 영역이라, 당장 대체보다는 생산성 도구로의 활용이 현실적인 시사점이다.
본문 미리보기
According to a Mercor study, current AI models now outperform licensed CPAs on structured accounting tasks in both speed and accuracy. Eighteen months ago, they still lagged far behind. On the more demanding APEX Benchmark, though, no model fully completes all the tasks. Without human oversight, AI still can't close the books on its own. The article AI beats licensed accountants on speed and accuracy, but still can't close the books without supervision appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안

