미스트랄 AI가 텍스트와 이미지를 동시에 처리하는 30억 파라미터 규모의 오픈소스 멀티모달 안전 분류 모델 '실드스트랄(Shieldstral)'을 공개했다. 고정된 유해성 카테고리 대신 "이 콘텐츠가 폭력을 조장하는가" 같은 자연어 질의에 0~1 점수로 답하는 방식이어서, 서비스 운영자가 모델 재학습 없이 프롬프트만 바꿔 서비스별로 다른 안전 기준을 적용할 수 있다. 텍스트 안전성 벤치마크에서 F1 84.9%를 기록해 7배 큰 GPT-OSS-세이프가드-20B와 동급 성능을 냈고, 멀티모달 평가에서도 83.8%로 옴니가드·라바가드를 앞섰다. 16GB 메모리의 단일 GPU로 구동 가능하고 아파치 2.0 라이선스로 상업적 활용도 가능하다.
- •자연어 질의 방식으로 위험도를 0~1 점수화해 재학습 없이 프롬프트만으로 안전 정책을 바꿀 수 있다.
- •텍스트 안전성 벤치마크에서 F1 84.9%로 7배 큰 GPT-OSS-세이프가드-20B와 동급 성능을 기록했다.
- •멀티모달(이미지·텍스트 혼합) 평가에서 83.8%로 옵니가드-7B·라바가드-7B를 앞졌다.
- •16GB 메모리의 단일 엔비디아 GPU로 구동 가능하며 아파치 2.0 라이선스로 상업적 이용이 가능하다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
미스트랄, 멀티모달 안전 모델 '실드스트랄' 오픈 공개...프롬프트로 맞춤형 가드레일 지원
본문 미리보기
콘텐츠 안전성을 확보하는 'AI 가드레일(Guardrail)' 기술의 중요성이 커지는 가운데, 미스트랄 AI가 서비스마다 다른 안전 기준을 프롬프트만으로 손쉽게 적용할 수 있는 경량 오픈소스 안전 모델을 공개했다. 대형 모델 중심이던 AI 콘텐츠 검열 시장에서 효율성과 맞춤형 정책 적용을 앞세운 새로운 대안이라고 강조했다. 미스트랄은 4일(현지시간) 텍스트와 이미지를 동시에 처리할 수 있는 30억(3B) 매개변수 규모의 오픈소스 안전 분류 모델 '실드스트랄(Shieldstral)'을 공개했다.기존의 고정된 유해성 분류 체계를 벗어나
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:57AI 초안
