대부분의 멀티 에이전트 실패는 환각이 아니라 '상속된 가정' 때문이다
Most Multi-Agent Failures Aren’t Hallucinations — They’re Inherited Assumptions
핵심 요약
멀티 에이전트 시스템의 실패는 환각보다 에이전트 간에 검증되지 않은 가정이 전파되는 현상 때문에 발생함.
- 상속된 가정 — 에이전트 간에 검증되지 않은 전제가 전파되면서 시스템 전체의 논리적 오류를 유발함.
- 실패 패턴 — 에이전트 체인, 긴 컨텍스트, 메모리 중심 시스템 등에서 일관되게 나타나는 문제임.
- 완화 전략 — 에이전트 간 검증 경계 설정, 명시적 불확실성 주입, 검증된 요약 전달 등이 효과적임.
- 독립적 수렴 — 숙련된 사용자들은 이미 작은 단위의 작업과 격리된 추론 상태를 통해 이를 해결하고 있음.
긴 컨텍스트와 멀티 에이전트 워크플로우를 한동안 다뤄본 결과, 많은 "LLM 실패"가 일반적인 의미의 환각이 아니라는 사실을 깨달았습니다.
그것은 바로 상속된 가정입니다.
에이전트 A가 약한 가정을 세웁니다.
에이전트 B는 이를 문맥적 진실로 상속받습니다.
에이전트 C는 일관성을 위해 그 가정을 중심으로 최적화합니다.
그 시점이 되면 시스템은 아무도 재검증하지 않은 전제를 바탕으로 추론하면서 매우 지능적으로 보일 수 있습니다.
저를 놀라게 한 점은 이런 현상이 다음 분야에서 얼마나 일관되게 나타나는가 하는 것입니다:
- 에이전트 체인
- 긴 컨텍스트 워크플로우
- 메모리 집약적 시스템
- 검색 파이프라인
- 오케스트레이션 프레임워크
공통적인 패턴은 프롬프트 품질보다는 통제되지 않은 추론 상태 전파와 더 관련이 있어 보입니다.
상당히 도움이 되었던 몇 가지 완화 패턴은 다음과 같습니다:
- 주요 결정 전 가정 열거 강제
- 에이전트 간 검증 경계 삽입
- 세분화된 실행 컨텍스트
- 명시적 불확실성 주입
- 원시 대화 기록 대신 검증된 요약 전달
아이러니하게도 많은 숙련된 사용자들은 독립적으로 비슷한 워크플로우로 수렴하는 것 같습니다:
더 작은 범위의 작업, 격리된 추론 상태, 통제된 메모리 전파.
저는 긴 컨텍스트 안정성과 추론 신뢰성을 실험하면서 이러한 패턴과 완화 프로토콜 중 일부를 무료 기술 가이드에 문서화했습니다.
멀티 에이전트 시스템을 구축하는 다른 분들도 비슷한 "가정 전파" 실패를 관찰했는지 궁금합니다.

