0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
APEX: Active Protection at Execution Boundaries for LLM Agents
- 1.간접 프롬프트 인젝션(IPI) 방어를 공격패턴 탐지가 아닌 '실행경계' 단일 지점으로 전환하는 APEX 제시
- 2.효과가 신뢰 가능한 작업에 의해 승인됐는지, 런타임 정보가 그 작업의 보증을 받았는지 두 조건만으로 판단
- 3.실행 전 컴파일된 단일 인가계약으로 증거기반 차단과 기만기반 노출 두 메커니즘을 적용
- 4.13개 베이스라인 대비 6개 벤치마크 중 5개서 공격성공률 0%, 나머지도 0.56%, 적응공격에도 전 유형 0% 유지
왜 중요한가?
Tools·MCP 서버·Skills 등 에이전트가 쓰는 능력 단위가 다양해질수록 공격 패턴을 일일이 막는 방식은 뒤처지는데, APEX는 패턴이 아닌 작업 권한 자체로 방어선을 세워 새로운 침투 경로에도 구조적으로 대응할 수 있음을 보여준다.
언급 프로젝트
본문 미리보기
arXiv:2610.06966v2 Announce Type: new Abstract: Indirect prompt injection (IPI) hides adversarial instructions in content that large language model (LLM) agents read at runtime. As agents compose heterogeneous capability units, including Tools, MCP servers, and Skills, the carriers of injection multiply, and defenses built to recognize attack patterns fall behind them. We instead shift defense from covering attack patterns to one stable point: whatever the carrier and however the injection prop
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

