LabGuard는 실험실 안전 규칙·매뉴얼·SOP 같은 자연어 문서를 기계가 검증 가능한 런타임 제약으로 변환해 실험실 로봇 에이전트에 적용하는 안전 스위트다. 타입이 지정된 실행 가능 표현인 LabGuard-IR, 203개 시드 규칙에서 확장한 812개 지도 어노테이션의 LabGuard-Bench, 자연어 규칙을 IR로 매핑하는 LabGuard-Grounder로 구성되며, 파이프라인이 IR을 런타임 모니터로 컴파일해 컨트롤러 경계에서 적용한다. 실험에서 미학습 규칙 소스에도 일반화해 task-scope F1 79.4를 기록했고, 위험 이벤트를 39.5%에서 23.8%로 줄였다. LabUtopia 환경에서는 ACT와 통합해 개입률 0.5% 미만으로 과제 성공률을 유지했다. 과학 실험 자동화가 확산되는 상황에서 자연어 안전 규정을 실행 가능한 가드로 잇는 중간 단계를 구체화했다는 의미가 있다.
- •자연어 실험실 규칙을 실행 가능한 런타임 가드로 변환하는 언어-실행 안전 스위트 LabGuard 제안
- •LabGuard-IR(타입 지정 표현), LabGuard-Bench(812개 어노테이션), LabGuard-Grounder 3개 컴포넌트로 구성
- •미학습 규칙 소스에 일반화, task-scope F1 79.4 달성
- •위험 이벤트 39.5%→23.8% 감소, LabUtopia에서 개입률 0.5% 미만으로 과제 성공률 유지
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
LabGuard: Grounding Natural-Language Laboratory Rules into Runtime Guards for Embodied Laboratory Agents
- 1.자연어 실험실 규칙을 실행 가능한 런타임 가드로 변환하는 안전 스위트 LabGuard 제안
- 2.타입 실행 표현 LabGuard-IR, 812개 주석 벤치마크, 규칙 매핑기 Grounder 3개 핵심 구성요소 포함
- 3.미보약 규칙 소스에 일반화하며 태스크 범위 F1 79.4 달성
- 4.런타임 모니터 컴파일 후 위험 이벤트를 39.5%에서 23.8%로 감소
왜 중요한가?
실험실 자율 에이전트의 안전 접근이 자연어 규칙을 기계 검증 가능한 제약으로 변환하는 중간 단계를 놓쳐온 문제를 해결한다. 개입을 0.5% 미만으로 유지하며 작업 성공률을 보존해, 동적 실험 환경에서의 실용적 안전 통제를 가능케 한다.
본문 미리보기
arXiv:2606.31045v1 Announce Type: new Abstract: Scientific embodied agents are increasingly capable of carrying out laboratory procedures, but executing these procedures safely in dynamic laboratory environments remains challenging. Current safety approaches often overlook the intermediate step of transforming laboratory natural language, including safety rules, manuals, protocols, and standard operating procedures, into machine-checkable runtime constraints. We introduce LabGuard (Laboratory G
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:08AI 초안

