자율 AI 에이전트의 거버넌스를 '에이전트'가 아닌 '행동' 단위로 통제하자는 제도적 증명(institutional attestation) 모델을 제안한 논문이다. 인간 제도가 강력한 자율 행위자를 추론 감시가 아니라 결정적 행동 시점의 독립 증거 요구로 통제해 온 패턴을 계산 가능한 거버넌스 모델로 형식화했다. 에이전트는 계획·추론의 자율성을 유지하되 고위험 행동의 실행 권한은 갖지 않으며, 실행은 독립 기관이 각각 증명한 전제조건, 암호학적으로 결합된 의도 선언, 결정론적 정책 평가를 거쳐야 한다. 모든 결정은 변조 감지 가능한 로그에 기록된다. 임상 처방과 프로덕션 소프트웨어 배포 사례로 개념 증명을 제시해, 되돌릴 수 없는 AI 행동에 대한 실용적 안전장치 설계 방향을 보여준다.
- •AI 추론 과정 감시 대신 결과적 행동 시점에 독립 증명을 요구하는 거버넌스 모델 형식화
- •에이전트는 계획·추론 자율성을 유지하되 지정된 고위험 행동의 실행 권한은 박탈
- •실행 조건: 독립 기관의 개별 증명, 의도 선언과의 암호학적 결합, 결정론적 정책 평가
- •모든 결정을 변조 감지 가능(tamper-evident) 로그에 기록해 독립 재검증 가능
- •임상 처방·소프트웨어 배포 사례로 개념 증명(PoC) 구현 제시
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems
- 1.자율 AI의 추론을 감시하는 대신 결과적 행동 시점에 독립 증명을 요구하는 거버넌스 모델 제안
- 2.에이전트는 계획·추론 자율성은 갖되 고위험 행동의 실행 권한은 보유하지 않음
- 3.실행은 독립 출처가 증명하고 의도에 암호학적으로 결속된 전제조건 충족 시에만 허용
- 4.모든 결정은 재검증 가능한 변조 방지 로그에 기록, 배포·임상 처방 예시로 시연
왜 중요한가?
임상 처방·프로덕션 배포처럼 되돌릴 수 없는 행동에 추론 감시가 아닌 인간 제도 방식의 증명 기반 통제를 적용해, 자율 에이전트 안전 거버넌스의 실용적 틀을 제시한다.
본문 미리보기
arXiv:2606.26298v1 Announce Type: new Abstract: Autonomous AI agents may begin to perform consequential, irreversible actions such as clinical prescribing and production software deployment. This paper observes that human institutions have governed powerful autonomous actors not by monitoring their reasoning but by requiring independently attested evidence at the point of consequential action. We formalise this institutional pattern as a computational governance model for AI agent systems. Unde
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:08AI 초안

