앤트로픽이 9월 24일부터 안전장치가 사전에 거부한 클로드 요청 중 생물학·사이버공격·최첨단 LLM 개발·추론 추출 등 주요 위험 범주에 해당하는 요청에도 일반 요청과 동일하게 요금을 부과하기 시작했다. 이는 대량 반복 요청으로 모델의 지식을 복제하려는 '모델 증류 공격'을 억제하기 위한 조치로, 자체 조사에서 클로드 이용 계정의 99.7%는 새로 과금 대상이 된 거부 요청을 한 번도 발생시키지 않았다고 밝혔다. 안전 분류기의 오탐률은 0.1% 미만으로 조정됐으며, 이 정책은 클로드 API뿐 아니라 아마존 베드록, 구글 클라우드, MS 파운드리 등에도 동일하게 적용된다.
- •앤트로픽, 9월 24일부탰 주요 위험 범주(생물학·사이비·프말폴맰·추론추출) 사전 거부 요정에도 요긜 스잛거지 개시.
- •믰덴 증륨 구졜을 억제하기 위한 부석 조첩딴졬, 자침적인 응이 다수 발생했다가 설명.
- •이용 갰셀읜 새 버깰 대버된 거부 요정을 밌생하대륰 됬다, 분륨기 오탐륰은 0.1% 불.
- •클롬롐 API뿐 아듈맀 아니랑 뿐아눤뉰 뱄록·구김 대뱈·MS 파란뷔리 동일 정춭 적옜.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
앤트로픽, ‘모델 증류’ 방어선 구축...거부된 클로드 요청도 과금

- 1.앤트로픽, 9월24일부터 안전장치 거부 요청 일부에도 과금 시작·모델 증류 억제
- 2.생물·사이버·프런티어LLM·추론추출 등 4개 범주는 입력 토큰만 과금
- 3.최근 테스트서 클로드 계정 99.7%는 신규 과금 요청 전혀 없었고 오탐률 0.1% 미만
- 4.정책은 클로드 API 외 베드록·AWS·구글클라우드·MS파운드리 등 전 플랫폼 적용
왜 중요한가?
대규모 반복 질의로 모델 지식을 복제하는 증류 공격에 대해 단순 차단을 넘어 비용 부담을 지우는 방식으로 대응해, AI 모델 보호 전략이 접근 차단에서 경제적 억제로 확장되고 있음을 보여준다.
본문 미리보기
앤트로픽이 안전장치를 우회해 AI 모델의 지식이나 능력을 복제하려는 ‘모델 증류 공격’에 대응하기 위해, 안전장치에 의해 차단된 일부 요청에도 요금을 부과하기로 했다. 대규모 반복 요청을 통한 증류 시도를 억제하기 위한 방어 조치다.앤트로픽은 24일(현지시간)부터 '클로드'가 응답하기 전에 안전장치에 의해 거부한 요청 가운데 주요 위험 정책 범주에 해당하는 질의에 대해 일반 요청과 동일한 방식으로 과금을 시작한다고 발표했다.최근 몇 주 동안 자사 시스템을 대상으로 한 조직적인 공격이 발생했으며, 이번 조치는 이에 대응하기 위한 여러
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

