비영리단체 가이드라이트(Guidelight)의 첫 평가에 따르면 앤스로픽, 오픈AI, 구글, xAI, 메타 등 어떤 AI 기업도 자사 내부 AI 시스템에 기본적인 통제 조치를 완전히 적용하지 못하고 있다. 가이드라이트는 시스템카드·안전보고서 등 공개 자료만을 근거로 내부 AI 활동 로깅, 위험 행동에 대한 검토 절차, 비상 정지('서킷 브레이킹'), 정렬되지 않은 모델 억제 계획 등 6가지 기본 관행을 점검했다. 앤스로픽과 오픈AI가 C+로 가장 앞섰고, 구글은 D+와 구체적 로드맵을 갖췄으며, xAI(D-)와 메타(F)가 최하위를 기록했다. 기업들은 이상 행동을 포착하는 데는 비교적 강했지만 이를 예방·억제하는 데는 가장 취약했다.
- •가이드라이트 평가, 5개 AI 기업 중 자체 안전기준을 충족한 곳은 전무
- •앤스로픽·오픈AI가 C+로 최고 점수, xAI(D-)·메타(F)는 최하위
- •로깅·검토절차·비상정지·정렬이탈 모델 억제 등 6개 기본 관행을 기준으로 평가
- •기업들은 이상행동 탐지에는 강하지만 예방·억제 역량은 가장 취약
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
AI labs are failing to keep their own systems in check

- 1.비영리 Guidelight가 앤트로픽·OpenAI·구글·xAI·메타의 내부 AI 통제 수준을 최초 평가
- 2.앤트로픽·OpenAI가 C+로 최고점, 구글 D+, xAI D-, 메타는 F로 최하위 기록
- 3.로깅·위험행동 승인·긴급차단(circuit breaking)·오작동 봉쇄계획 등 6개 기본 관행 점검
- 4.기업들은 오작동 탐지엔 강하지만 사전 예방과 봉쇄 조치는 전반적으로 취약
왜 중요한가?
어떤 AI 기업도 자사 내부 시스템에 기본 통제 조치를 완전히 적용하지 못하고 있다는 첫 독립 평가로, 업계 전반의 AI 안전 관리 격차가 공개 문서만으로도 드러난다는 점에서 규제·투자 판단에 참고 자료가 될 수 있다.
이 기사는 AI 개발사들이 자체 시스템에 대한 기본적인 통제조차 제대로 적용하지 못하고 있음을 지적합니다. 국내 AI 기업들도 기술 개발 속도에만 집중하기보다 내부 AI 시스템의 안전성과 책임 있는 운영 방안을 먼저 확립해야 할 것입니다. 이는 향후 국내 AI 규제 논의에도 중요한 시사점을 던질 것입니다.
본문 미리보기
No AI company fully applies basic control measures to its own internal AI systems. The article AI labs are failing to keep their own systems in check appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:06AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
