앤트로픽이 2026년 8월 7일 클로드 페이블 5의 생물학 안전장치를 업데이트해 생물학 관련 '폴백'(오퍼스 5로의 자동 전환)을 테스트에서 약 85% 줄였다고 밝혔다. 이번 개선으로 전체 폴백 발생률이 표면별로 Claude.ai에서 67%, Cowork에서 55%, Claude Code에서 17%, Claude Platform에서 7% 감소할 것으로 추정된다. 다만 바이러스학·독성학·분자 설계 등 이중용도 전문 생물학 연구는 여전히 오퍼스 5로 전환되며, 회사는 페이블 5가 "아직 전문 생물학 연구·신약 개발에는 사용할 수 없다"고 명시했다. 시스템 카드는 페이블 5를 알려진 무기 관련 공정에서 기초 기술자를 상당히 도울 수 있는 'CB-1' 수준으로 평가하되, 신종 생물무기 개발급 전문성을 대체하는 'CB-2' 문턱은 넘지 않는다고 판단했다. 안전 분류기의 판단 기준을 재작성하고 재훈련해 이전에는 안전 마진 안에서 차단되던 양성 요청들을 허용하도록 경계를 조정했으며, 향후 검증된 연구자를 위한 '신뢰 기반 접근' 경로로 격차를 좁힐 계획이다.
- •생물학 폴백이 약 85% 감소하며 Claude.ai는 67%, Cowork는 55%, Claude Code는 17%, Platform은 7% 전체 폴백이 줄 것으로 추산
- •시스템 카드상 페이블 5는 'CB-1' 수준으로 평가되며 신종 생물무기급 'CB-2' 문턴은 넘지 않았다고 판단
- •바이러스학·독성학·분자 설계 등 이중용도 연구는 여전히 오퍼스 5로 폴백
- •미국 정보당국의 2026년 연간 위협 평가를 근거로 합성생물학·유전체 편집 기술의 신종 위협 가능성 언급
- •출시 당시 광범위하게 차단하던 리스크 횜피 전략을 이제 측정 가능한 폴백률로 조정하는 입장
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Anthropic Retunes Fable 5’s Biology Safeguards, Cutting Blocked Queries 85%

본문 미리보기
Anthropic on August 7, 2026 released an update to the biology safeguards on Claude Fable 5 that the company says cut biology-related "fallbacks" by about 85% in testing across its product surfaces — the automatic handoffs that route a user's query to a less capable model when the system judges a request touches safeguarded biology territory. In its announcement, Anthropic said users should now see far fewer fallbacks on everyday health and educational questions, such as interpreting lab…
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:11AI 초안

