엔비디아가 네모트론(Nemotron) 기반 모델을 특화 미세조정해 국제정보올림피아드(IOI)와 국제수학올림피아드(IMO) 모두에서 금메달 수준 성과를 달성했다고 발표했다. IOI 2026에서는 'Nemotron-3-Ultra-CC'가 지도학습과 '젠코렉트(GenCorrect)' 생성-검증-수정 루프를 결합해 600점 만점에 535.4점을 기록해 금메달 기준(361.12점)과 인간 최고 점수(498.27점)를 모두 넘어섰다. IMO 2026에서는 일반·지도학습·강화학습 체크포인트를 결합한 시스템이 42점 만점에 30점을 받아 공식 금메달 기준(29점)을 넘겼으며, 외부 도구나 형식 증명기 없이 자연어만으로 증명을 생성했다. 모델과 데이터셋, 학습 레시피는 허깅페이스를 통해 공개됐다.
- •엔비디아 네모트론, IOI·IMO 2026 양쪽에서 금메달 수준 성과 달성
- •IOI: Nemotron-3-Ultra-CC가 600점 만점 535.4점, 금메달 기준·인간 최고점 모두 상회
- •IMO: 멀티체크포인트 시스템이 42점 만점 30점, 공식 증명기 없이 자연어로만 증명
- •'젠코렉트' 생성-검증-수정 루프가 미세조정 효과를 추가로 끌어올림
- •모델·데이터셋·학습 레시피를 허깅페이스에 공개
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO
- 1.Nemotron 3 특화 모델이 IOI·IMO 2026에서 동시에 금메달 수준 달성
- 2.IOI 2026: Nemotron-3-Ultra-CC 535.4/600점, 금메달 기준·인간 최고점 모두 상회
- 3.IMO 2026: SFT+RL 조합 시스템 30/42점으로 금메달 기준(29점) 상회, 4문제 만점
- 4.IOI는 2.2만 문제+GenCorrect 반복검증, IMO는 41만여 증명 예제로 특화 훈련
왜 중요한가?
범용 기반모델을 도메인별로 파인튜닝해 알고리즘(IOI)과 수학 증명(IMO)이라는 서로 다른 두 경시대회에서 동시에 금메달 수준을 달성, 재사용 가능한 특화 레시피(SFT+RL+생성-검증-개선 추론 루프)의 실효성을 보여준다. 체크포인트·데이터셋·벤치마크를 모두 공개해 외부 개발자가 동일 방식을 재현할 수 있게 한 점도 의미가 크다.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:39AI 초안

