데이터 분석업체 머코어가 발표한 평가에서 앤트로픽의 클로드 오퍼스 5가 실제 회계 업무 벤치마크를 100%에 가까운 정확도로 완수해, 인간 회계사 평균 정확도 37%를 크게 앞섰다. 공인회계사 12명이 겨룬 이번 테스트에서 회계사들은 과제당 최대 180분이 걸렸지만 AI는 10분 이내에 끝냈고, 비용도 AI가 0.21달러로 회계사(10.35달러)보다 50배 저렴했다. 18개월 전만 해도 최상위 모델조차 회계사 평균에 못 미쳤던 점을 고려하면 급격한 성장이다. 연구진은 이를 '인간 대체'가 아니라 비용·시간 제약으로 인간이 할 수 없었던 대량 정밀작업을 AI가 수행하는 방향으로 벤치마크 패러다임이 이동하는 사례로 해석했다.
- •머코어 평가에서 클로드 오퍼스 5가 회계 벤치마크 100%에 근접, 회계사 평균 37%를 압도
- •회계사는 과제당 최대 180분, AI는 10분 이내 완료
- •AI 비용 0.21달러 vs 회계사 10.35달러로 약 50배 차이
- •18개월 전 GPT-4o는 0%에 가까운 점수, 이후 급성장
- •연구진은 '인간 대체'가 아닌 벤치마크 패러다임 전환의 사례로 해석
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
회계 업무서 AI '100%’ vs 인간 '37%'...역전 18개월 만에 '완벽' 단계로

- 1.머코어 평가서 앤트로픽 '클로드 오퍼스 5', 회계 업무 정확도 100%에 근접
- 2.인간 회계사(CPA, 평균 경력 5.5년) 평균 정확도는 37%에 그쳐
- 3.AI는 작업당 0.21달러, 회계사는 10.35달러로 비용 약 50배 차이
- 4.18개월 전 GPT-4o는 0%였으나 가파르게 성장, 오픈소스 '큐원3.5-122B'는 여전히 평균 이하
왜 중요한가?
구조화된 세부 회계 업무에서 AI가 인간을 압도하는 수준에 도달했다는 결과로, 연구진은 이를 인간 대체가 아니라 비용·시간 제약으로 불가능했던 대량 작업을 AI가 수행하는 쪽으로 벤치마크 패러다임이 이동하는 신호로 해석한다.
본문 미리보기
최첨단 AI 모델이 월말 결산과 같은 세부 회계 업무를 '100%'에 가깝게 완수하며 사실상 '완벽' 단계에 들어섰다는 연구 결과가 나왔다. 다만 연구진은 이번 결과를 단순히 '인간 직무 대체'로 해석하기보다, 인간이 시간·비용의 한계로 하지 못했던 정교한 대량 작업을 AI가 어떻게 해내는가로 벤치마크의 평가 패러다임이 이동하고 있음을 보여주는 핵심 사례로 조명했다.데이터 분석 전문 머코어(Mercor)가 1일(현지시간) 발표한 평가 결과에 따르면, 앤트로픽의 '클로드 오퍼스 5'는 실제와 유사한 회계 업무 벤치마크 평가에서 100
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

