지속적으로 작동하는 AI 에이전트는 신념을 수정하고 메모리를 통합하며 실행 기반을 교체하는데, 비슷해 보이는 후속 상태라도 서로 다르게 권한이 부여된 전환 주장을 수반할 수 있고 정당한 발전이라도 상태가 크게 바뀔 수 있다. 연구팀은 범위가 지정된 권한, 출처, 결정론적 적용, 의미 술어, 후보 지속 영수증을 이용해 제출된 전환을 검증하는 정책 상대적 계약인 '인지 연속성 테스트(CCT)'를 제안한다. CCT는 검증된 허용 가능성, 긍정적 위반, 미해결 필요 증거를 구분한다. 24개의 생성된 전환 가족을 제공하는 IdentityLineageBench에서 참조 사후 해결 검증기는 576개의 표준 보류 라벨을 모두 맞혔고, 어휘적 상태 유사도와 계보 전용 진단 기준선은 각각 무효 픽스처의 60.0%, 80.0%만 허용해 참조 검증기의 우위를 보였다. 1만 8000건 실행에 대한 유효 경로 연구에서 상주 입력에 대한 기본 중앙값 지연시간은 6.21ms로 측정됐다.
- •지속적으로 작동하는 AI 에이전트의 후속 상태 전환을 검증하기 위해 범위가 지정된 권한, 출처, 결정론적 적용 등을 이용하는 인지 연속성 테스트(CCT)를 제안.
- •CCT는 검증된 허용 가능성, 긍정적 위반, 미해결 필요 증거라는 세 가지 판정을 구분.
- •IdentityLineageBench에서 참조 검증기가 576개 표준 라벨을 모두 맞혔고, 단순 유사도와 계보 전용 기준선은 무효 픽스처의 60에서 80퍼센트만 걸러내는 한계를 보임.
- •1만 8000건 실행 연구에서 상주 입력에 대한 기본 중앙값 지연시간은 6.21밀리초로 측정됨.
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
The Cognitive Continuity Test: Verifying Governed State Transitions in Persistent AI Agents
- 1.영속 AI 에이전트의 상태전환 검증 계약 'CCT(인지적 연속성 테스트)' 제안, 범위 지정 권한과 결정론적 적용을 요구
- 2.IdentityLineageBench 24개 전환 패밀리·576개 레이블 전량을 정답 검증기가 정확히 일치
- 3.어휘 유사도 베이스라인은 잘못된 전환의 60%를 통과, 계보만 보는 베이스라인은 80%를 통과시켜 부정확함 입증
- 4.1만8000회 실행 연구에서 정상 경로 기준 중앙값 6.21ms의 처리 지연 측정
왜 중요한가?
에이전트가 스스로 신념을 수정하고 메모리를 통합하거나 실행 기반을 교체할 때, '유사해 보이는 후속 상태'가 실제로는 승인되지 않은 전환일 수 있다는 위험을 정량적으로 드러내고 이를 구분하는 방법을 제시한다.
언급 프로젝트
본문 미리보기
arXiv:2610.00132v1 Announce Type: new Abstract: Persistent AI agents revise beliefs, consolidate memory, and replace execution substrates. Similar successor states can accompany differently authorized transition claims, while legitimate development can change state substantially. We introduce the Cognitive Continuity Test (CCT), a policy-relative contract for verifying submitted transitions using scoped authority, provenance, deterministic application, semantic predicates, and candidate-persist
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:24AI 초안

