LLM 에이전트가 여러 홉(hop)에 걸쳐 정보를 전달할 때 메시지 형식의 영향이 릴레이 모델의 성능 티어에 따라 달라진다는 것을 통제 실험으로 보였다. 12개 원자적 사실을 5가지 형식(자연어, 정밀 지시 자연어, JSON, 트리플, 키-값)으로 6홉 릴레이한 결과, 강한 릴레이는 거의 무손실이었지만 1.5B급 약한 릴레이에서는 형식 간 회상률 격차가 8.7배(2.3→20.5점)로 벌어졌다. 주입된 오류 값은 형식과 무관하게 83~100% 확률로 마지막 홉까지 유지돼, 구조화 형식은 오류를 교정하는 코드가 아니라 충실히 전달하는 채널임을 확인했다. 멀티에이전트 파이프라인의 메시지 형식은 가장 약한 릴레이 모델을 기준으로 선택해야 한다는 실무적 시사점을 준다.
- •5가지 메시지 형식(자연어·JSON·트리플·키-값 등)으로 12개 사실을 6홉 릴레이하는 통제 테스트베드 구축
- •강한 릴레이는 거의 무손실로 '전화 게임' 붕괴가 없었고, 홉당 인지 부하를 추가해도 충실도 변화는 ±1.8점 이내(생성 비용은 24~53% 증가)
- •약한 1.5B 릴레이에서는 형식 간 6홉 회상률 격차가 8.7배로 확대되고 형식 순위가 전송 중 역전됨
- •주입된 오류 값은 모든 형식에서 83~100% 확률로 최종 홉까지 잔존 — 구조는 오류 교정이 아닌 오류 국지화 채널
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent
- 1.LLM 에이전트 간 메시지 포맷 효과가 릴레이 모델 성능 티어에 따라 달라짐을 6홉 중계 실험으로 규명
- 2.강한 릴레이는 거의 무손실 — 알려진 '전화게임 붕괴'는 발생하지 않음
- 3.약한 1.5B 릴레이에서는 포맷간 회상률 편차가 8.7배 확대, 고정키 JSON이 드리프트 저항성 보유
- 4.주입된 오류값은 모든 포맷에서 83~100% 끝까지 잔존 — 구조는 오류 교정이 아닌 충실 전달 채널
왜 중요한가?
멀티에이전트 파이프라인의 메시지 포맷 선택은 '가장 약한 릴레이 모델'에 맞춰야 한다는 실용 지침을 제시한다. 구조화 포맷이 오류를 자동 교정해주지 않으며, 한 번 들어간 잘못된 값은 끝까지 전파된다는 점은 에이전트 체인 검증 설계에 중요한 경고다.
LLM 에이전트 간 정보 전달 시 메시지 형식이 미치는 영향에 대한 이 연구는 국내 멀티 에이전트 시스템 및 협업 AI 개발자들에게 중요한 시사점을 제공합니다. 에이전트 간의 효율적이고 정확한 정보 교환은 복잡한 AI 솔루션의 성능을 좌우하며, 국내 기업들이 비용 효율적이면서도 견고한 AI 생태계를 구축하는 데 필수적인 고려사항이 될 것입니다.
본문 미리보기
arXiv:2607.09678v1 Announce Type: new Abstract: When LLM agents hand off information to one another, does the message format matter? Two literatures disagree: format-optimization work reports that structured messages cut cost without hurting accuracy, while format-restriction work finds that imposing structure degrades generation -- and neither measures what happens when a message traverses multiple hops, where copy fidelity, not one-shot generation, dominates. We introduce a controlled relay t
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 13:08AI 초안

