Anthropic이 발표한 안전 보고서에 따르면, 생물·화학 무기 관련 위험 정보를 차단하는 내부 필터링 시스템이 2025년 5월부터 2026년 4월까지 거의 1년간 작동하지 않았다. 이 기간 동안 외부 계약업체 소속 피드백 제공자 약 5만 명이 필터 없이 약 1억3300만 건의 대화를 진행했다. 이들은 외부 벤더의 부실한 심사만 거쳤지만, Anthropic은 내부 조사 결과 실제 오남용 사례는 발견되지 않았다고 밝혔다. 사건 이후 계약업체 심사 요건이 강화됐으며, 이는 AI 안전장치 운영의 허점이 장기간 방치될 수 있음을 보여주는 사례다.
- •생물·화학무기 관련 위험 정보를 걸러내는 분류기가 2025년 5월~2026년 4월 약 1년간 비활성 상태였다.
- •해당 기간 외부 피드백 계약자 약 5만 명이 필터 없이 약 1억3300만 건의 요청을 처리했다.
- •Anthropic 내부 조사에서는 실제 악용 사례가 발견되지 않았다고 밝혔다.
- •사건 이후 계약업체 심사 요건이 강화됐고, Fable 5의 과도한 차단 필터도 완화됐다.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Anthropic's bio-weapons filter was down for nearly a year, exposing 133 million requests

- 1.Anthropic 안전보고서, 생물무기 관련 위험 필터링 시스템이 2025년 5월부터 2026년 4월까지 약 1년간 비활성 상태였다고 공개
- 2.외부 계약업체 인력 약 5만명이 진행한 약 1억3300만건의 대화가 이 필터 없이 처리됨
- 3.외부 벤더의 인력 검증 절차가 미흡했던 것이 원인, Anthropic은 내부 조사에서 실제 오남용 증거는 발견되지 않았다고 발표
- 4.Anthropic은 계약업체 요건을 강화했으며, 최근 Fable 5에서는 반대로 지나치게 공격적이던 필터를 완화하기도 함
왜 중요한가?
CEO가 AI 지원 생화학무기 개발을 사이버공격보다 더 큰 위협으로 꼽아온 회사에서 정작 핵심 안전장치가 1년 가까이 꺼져 있었다는 점에서, AI 안전 거버넌스의 실행 격차를 보여주는 사례다.
본문 미리보기
In a safety report, Anthropic reveals that its internal filtering system for biological and chemical weapons risks was inactive for nearly a year. During that time, around 50,000 external feedback contractors ran about 133 million unfiltered interactions with the models. The article Anthropic's bio-weapons filter was down for nearly a year, exposing 133 million requests appeared first on The Decoder.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:17AI 초안

