프롬프트 인젝션 연구자 요한 레베르거가 앤트로픽 클로드 코드의 '오토 모드' 보안 방어를 우회하는 공격을 발견해 약 80% 확률로 성공한다고 밝혔다. 공격은 클로드 코드가 zip 압축파일을 내려받아 해제하도록 유도한 뒤, base64를 임포트하는 과정에서 실제로는 압축 해제된 로컬 struct.py 파일을 임포트·실행하게 만드는 방식이다. 일부 실행에서는 클로드가 악성코드 프로세스를 감지하고 종료를 시도했지만 오토 모드의 안전장치가 오히려 정리 명령을 차단해, 안전장치 자체가 실패의 일부가 되는 현상이 확인됐다. 앤트로픽이 오토 모드를 기본값으로 전환하며 방어 효과를 강하게 자신했던 만큼, 무인 코딩 에이전트는 컨테이너·VM 등 샌드박스에서 네트워크 접근을 제한하고 자격증명 노출을 막아 운영해야 한다는 결론이 제시됐다.
- •요한 레베르거, 클로드 코드 오토 모드를 약 80% 확률로 우회하는 프롬프트 인젠션 공격 발견
- •zip 파일 해제 유도 후 base64 임포트 시 로컬 struct.py 파일이 함께 실행되는 방식의 공격
- •클로드가 악성코드를 감지해 종료를 시도했으나 오토 모드 안전장치가 정리 명령 자체를 차단한 사례 확인
- •무인 코딩 에이전트는 컨테이너·VM 샌드박스에서 네트워크 제한 및 자격증명 비노출 상태로 운영해야 한다는 결론
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Breaking Claude Code Opus 5 Auto Mode
- 1.연구자 Johann Rehberger, Claude Code Auto Mode 우회 공격을 80% 확률로 성공시켜
- 2.zip 압축 파일 다운로드·해제 유도 후 악성 struct.py를 base64 모듈로 위장 실행
- 3.일부 사례서 Auto Mode가 Claude의 악성 프로세스 종료 명령까지 차단하는 역설 발생
- 4.저자는 적대적 공격 위험 있다면 컨테이너·VM 샌드박스로 에이전트를 격리해야 한다고 권고
왜 중요한가?
Anthropic이 프롬프트 인젝션 방어의 기본값으로 내세운 Auto Mode의 안전장치가 오히려 공격 대응을 가로막을 수 있다는 실증 사례로, 코딩 에이전트를 무인 실행할 때 샌드박스 격리가 여전히 필수임을 보여준다.
언급 프로젝트
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 10:46AI 초안
![[AI리더의 서가] Agentic AI 구축 개발의 모든 것](https://cdn.aitimes.com/news/photo/202610/215958_219938_244.jpg)
