Venkat Peri의 에이전트 아키텍처 논평 — 2026년 지배적 논리인 '에이전트 하네스(Claude Cowork 등)가 앱이 된다'가 프로덕션 안전성 관점에서 **미숙한 판단**이라는 주장. MIT/USC 연구(2026-03)에 따르면 미국 연방법원 pro se(자가 대리) 비율이 11%→16.8%로 상승했는데 모두 '템플릿화 가능' 사건(시민권·소비자금융·압류)이고 특화 영역(특허·증권 PSLRA·qui tam)은 변화 없음. 저자 요지: skill 파일의 prose 지시('검증 후 제출')는 확률적 해석에 의존 — 강제되지 않음. 반면 `def submit_filing(draft): validate()` 같은 **코드 레벨 게이트**는 반드시 실행됨. 하네스가 필요한 5가지: (1) orchestrator가 skill 강제 발동, (2) skill 내 코드 레벨 gate, (3) 영구 audit state, (4) human-in-the-loop 깨끗한 pause/resume, (5) long-task 전반 context stability. 결론: 하네스는 실행 환경일 뿐 정책 엔진 아님. 정책은 코드 파이프라인으로 하네스 바깥에 둬라.
- •미국 연방법원 pro se 11→16.8% 상승 — 전부 '템플릿화 가능' 사건군에서만.
- •Skill prose는 확률적 해석 — 에이전트 판단에 맡김, 강제 불가.
- •코드 레벨 gate만이 실제 강제 — `validate()` 함수 없이 return 불가 구조.
- •하네스 필요 5대 기능: skill 강제 발동·코드 gate·영구 audit·clean HIL·context stability.
- •결론: 하네스는 실행 환경이지 정책 엔진 아님 — 정책은 코드 파이프라인 바깥 배치.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Prose Is a Suggestion. Agent Harnesses Need Cages.

- 1.에이전트 하네스(Claude Cowork 등)가 'policy engine'이 될 수 없다는 구조적 진단.
- 2.Skill prose 지시는 확률적 — 코드 레벨 gate만이 강제 실행 보증.
- 3.하네스 필수 5대 기능: 강제 skill 발동·코드 gate·영구 audit·HIL·context stability.
- 4.Blast radius > 규제 — CRM mutation·이메일 송신·회계 카테고리화도 동일 위험.
- 5.실전 아키텍처: 에이전트를 '파이프라인 cage' 안에서 판단이 필요한 노드만 채움.
왜 중요한가?
한국 금융·핀테크·법무 SaaS가 Claude Cowork·Cursor agent 기반 에이전트 제품 구축 시 필수 설계 원칙. '하네스가 앱'이라는 VC·벤더 피칭을 그대로 믿으면 production incident 발생. 특히 한국 자본시장법·개인정보법 영역에서 '정책은 코드 바깥' 원칙 안 지키면 규제 리스크 직결.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:34AI 초안

