카카오가 오픈소스로 공개한 경량 언어모델 카나나-2 시리즈의 안전성 평가 결과를 18일 발표했다. 자체 'AI 안전성 평가 플랫폼'과 한국어 특화 벤치마크 'AssurAI'(35개 리스크 카테고리, 9560개 평가 항목)를 활용해 Kanana-2-1.3B-Instruct와 3B-Instruct를 평가한 결과 각각 종합 점수 0.70을 기록했다. 이는 유사 규모의 구글 젬마(0.68·0.66)와 알리바바 큐웬(0.58·0.62)보다 높은 수치로, 비교군 대비 최고 수준의 안전성을 입증했다. 1.3B 모델은 범죄·불법행위 영역에서, 3B 모델은 성적 콘텐츠·아동보호 및 권리침해 영역에서 특히 우위를 보였다. 카카오는 향후 모든 공개 모델에 상시 사전 안전성 평가를 적용하고 멀티모달·에이전틱 AI 리스크로 평가 범위를 넓힐 계획이다.
- •Kanana-2-1.3B·3B 모두 종합 점수 0.70으로 구글 젬마, 알리바바 큐웬보다 우위
- •한국어 특화 벤치마크 'AssurAI'(35개 카테고리, 9560개 항목) 기반 평가
- •1.3B는 범죄/불법행위, 3B는 성적 콘텐츠/아동보호·권리침해 영역서 강점
- •향후 모든 공개 모델에 상시 사전 안전성 평가 적용 계획
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
카카오, 경량 언어모델 Kanana-2 시리즈 안전성 평가 결과 공개... 글로벌 모델 대비 최고 수준 기록
- 1.카카오, 오픈소스 경량모델 Kanana-2 시리즈 안전성 평가 결과 공개…동급 글로벌모델 대비 종합 1위
- 2.한국어 특화 벤치마크 AssurAI(35개 리스크카테고리, 9,560건)로 젠마·큐웨과 비교 측정
- 3.Kanana-2-1.3B 0.70점(Gemma 0.68·Qwen 0.58), 3B도 0.70점으로 두 모델 모두 상회
- 4.1.3B는 범죄/불법행위, 3B는 성적콘텐츠/아동보호·권리침해 영역에서 우위
왜 중요한가?
오픈소스로 공개한 자국어 경량모델의 안전성을 자체 개발 한국어 벤치마크로 정량 검증해 결과를 투명하게 공개했다는 점에서, 국내 AI 안전성 평가 관행 확립과 오픈모델 신뢰도 제고에 기여한다.
본문 미리보기
카카오(대표이사 정신아)가 오픈소스로 공개한 경량 언어모델(SLM) 카나나(Kanana-2)시리즈의 안전성 평가 결과를 18일 공개했다.카카오는 자체 구축한 'AI 안전성 평가 플랫폼'을 통해 지난달 28일, 허깅페이스에 오픈소스(다운)로 공개한 ‘Kanana-2-1.3B-Instruct’, ‘Kanana-2-3B-Instruct’ 두 모델을 대상으로 유해성, 편향성 등을 체계적으로 측정했다. 그 결과, 두 모델 모두 유사 파라미터 규모의 주요 글로벌 모델 대비 종합 1위를 기록했다.이번 평가에는 과학기술정보통신부 사업의 일환으로
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:56AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
