과기정통부가 27일 '독자 AI 파운데이션 모델'(독파모) 2차 단계평가의 세부 점수를 전면 공개했다. 글로벌 벤치마크 AAII에서 4개 참여팀 중 1위를 차지하고도 종합 4위로 탈락한 모티프테크놀로지스가 강하게 반발하며 세부 공개를 요청한 데 따른 조치다. 100점 만점(벤치마크 45점·전문가평가 35점·사용자평가 25점) 기준 SKT가 70.6점으로 종합 1위, 업스테이지 69.9점, LG AI연구원 69.0점, 모티프 65.8점 순이었다. 모티프는 AAII 벤치마크(11.9점)에서 압도적 1위였지만 전문가평가·AI전문사용자평가·일반국민평가에서 모두 4위에 그쳤다. 배경훈 부총리는 3~6개월 단위로 급변하는 AI 트렌드에 맞춰 평가 방식 개편을 검토하겠다고 밝혔으며, 3차 평가에는 AI 에이전트·고난도 추론 등 최신 트렌드가 반영될 전망이다.
- •과기정통부, 모티프의 요청으로 독파모 2차 평가 세부 점수 전면 공개
- •종합 점수 SKT 70.6점 1위, 업스테이지 69.9점, LG AI연구원 69.0점, 모티프 65.8점 순
- •모티프, AAII 글로벌 벤치마크는 11.9점으로 1위였으나 전문가·사용자·국민 평가에서 모두 4위(최하위)
- •배경훈 부총리, 급변하는 AI 트렌드 반영 못하는 평가 방식 개편 검토 시사, 3차 평가에 에이전트·추론 트렌드 반영 예정
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
정부, 모티프 반발 속 독파모 2차 전체 점수 공개…SKT 1위
- 1.독파모 2차 평가서 SKT 70.6점 종합 1위, 업스테이지·LG AI연구원·모티프 순
- 2.AAII 글로벌 벤치마크 1위였던 모티프, 전문가·사용자·국민평가서 전부 4위로 탈락
- 3.모티프 반발로 정부가 벤치마크·전문가·사용자 평가 세부 점수 이례적 공개
- 4.과기정통부, 3차 평가엔 AI 에이전트·추론·코딩 등 최신 트렌드 반영해 개편 검토
왜 중요한가?
글로벌 벤치마크 1위 기업이 정성평가에서 탈락한 결과가 독파모 평가체계의 신뢰성 논란을 촉발했으며, 정부가 3차 평가부터 최신 AI 트렌드를 반영해 기준을 개편하겠다고 밝히면서 국내 AI 파운데이션 모델 지원 정책의 방향 전환이 예상된다.
본문 미리보기
정부가 '독자 인공지능(AI) 파운데이션 모델(독파모)' 프로젝트 2차 평가의 세부 점수를 공개했다. 글로벌 벤치마크에서 가장 높은 점수를 기록하고도 최하위로 탈락한 모티프테크놀로지스(모티프)가 평가 결과에 대한 반발하며 세부 공개를 요청했기 때문이다. AAII 1위 모티프…국민·전문가 평가서 최하위과학기술정보통신부(과기정통부)는 27일 독파모 2차 단계평가의 벤치마크·전문가·사용자 평가 세부 결과를 공개했다.당초 독파모 평가 결과는 기업들에 대한 낙인 효과를 우려해 제한적으로만 공개됐다. 그러나 최근 글로벌 성능 평가에서 1위를
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:33AI 초안
