구글이 싱가포르 AI 안전연구소, 오픈마인디드, AVERI, MLCommons와 협력해 세계 최초로 프런티어 AI 모델의 '이중맹검' 평가를 시범 운영한다고 밝혔다. 구글 클라우드의 컨피덴셜 스페이스를 활용해 평가기관은 제미나이 모델 가중치를, 구글은 평가기관의 비공개 테스트 프롬프트를 서로 볼 수 없게 암호학적으로 격리한다. 이는 모델이 벤치마크 문제를 사전에 학습해 점수가 부풀려지는 '벤치마크 오염'을 차단하기 위한 조치로, 첫 파일럿은 제미나이 플래시 라이트 모델을 대상으로 진행된다. 구글은 사이버보안 등 민감한 안전성 평가에서도 이 방식이 독립 검증의 신뢰성을 높일 것으로 기대했다.
- •구글, 싱가포르 AI안전연구소·오픈마인디드·AVERI·MLCommons와 이중맹검 평가 시범 운영
- •구글 클라우드 컴피덴셔 스페이스(기밀 컴퓨팅)로 모델 가중치와 평가 데이터를 상호 차단
- •목표는 모델이 벤치마크 문제를 미리 학습해 점수가 부풀려지는 '벤치마크 오염' 방지
- •첫 파일럷은 제미나이 플래시 라이트 모델을 비공개 벤치마크와 개인정보보호 환경에서 평가
- •사이버보안·국가 AI 안전성 평가 등 민감 영역의 독립 검증 신뢰성 제고에 활용 기대
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
구글, AI 평가도 ‘이중맹검’ 시대 연다…“모델도 시험문제도 서로 못 본다”
본문 미리보기
구글이 고성능 인공지능(AI) 모델의 성능과 안전성을 평가하는 과정에서 모델과 평가 데이터 어느 쪽도 상대방의 내용을 볼 수 없도록 하는 ‘이중맹검(Double-Blind)’ 평가 방식을 선보였다. AI 모델이 평가에 사용되는 질문이나 테스트 데이터를 사전에 접하면 해당 데이터를 학습하거나 최적화에 활용할 가능성이 있어 실제 능력보다 높은 평가 결과가 나올 수 있다는 이른바 ‘벤치마크 오염(Benchmark Contamination)’ 문제를 해결하기 위한 조치다.구글은 지난 27일(현지시간) 싱가포르 AI 안전연구소(Singapo
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:11AI 초안



