Doxa를 활용한 지정학적 다중 에이전트 시뮬레이션에서 Qwen 2.5 7B 테스트: 자원 제약과 페르소나 적용
Testing Qwen 2.5 7B for geopolitical multi-agent simulations in Doxa, with resource constraints and personas
핵심 요약
Qwen 2.5 7B 모델을 이용해 지정학적 시뮬레이션을 수행한 결과, 에이전트들이 실제 결과보다 대외적인 선전에 치중하는 흥미로운 현상이 관찰됨.
- 지정학적 시뮬레이션 — Doxa 엔진을 사용하여 호르무즈 해협 시나리오에서 5개 에이전트의 상호작용을 테스트함.
- 페르소나 도입 — 미국과 이란 등 각 국가에 고유한 성향과 정치적 자본 제약을 부여하여 현실적인 갈등을 유도함.
- 에이전트의 기만 — AI 에이전트들이 실제 협상 상황과 무관하게 대외적인 승리를 주장하는 등 현실적인 정치적 거짓말을 보여줌.
- 향후 계획 — RAG를 넘어 에이전트 오케스트레이션에 Langchain을 통합하는 방안을 고려 중임.
지난 며칠 동안 Doxa 지정학적-경제적 시뮬레이션 엔진을 테스트하기 위해 호르무즈 해협 시나리오를 5명의 행위자로 재현하여 에이전트들의 창발적 결과를 분석했습니다.
미국 에이전트에게는 "포퓰리스트" 페르소나를, 이란 에이전트에게는 "생존주의 정권" 페르소나를 부여했습니다. 또한 게임 오버를 피하기 위해 유지해야 하는 political_capital(정치적 자본)이라는 자원을 추가했습니다.
하지만 결과는 거짓된 대중적 소통으로 가득 찬 교착 상태로 돌아갔습니다(꽤 현실적이라고 생각합니다). 미국 AI 에이전트들은 협상이 진행 중임에도 불구하고 "우리가 봉쇄를 해제했다! 역대급 승리다! 이란이 울고 있다!"라고 말하기까지 했습니다. 당연히 "이스라엘" AI는 모든 것을 무시하고 걸프 국가들에 대한 폭격과 압박을 계속했습니다. 유럽이나 중국은 모델링되지 않았습니다.
시뮬레이션은 T4 GPU와 Qwen2.5:7B(작은 AI들이죠)를 사용하여 1시간 동안 진행되었기에 결과는 매우 창발적이고 어쩌면 예측 가능할 수도 있지만, 확실히 재미있었습니다. 우리는 Langchain을 RAG뿐만 아니라 에이전트 오케스트레이션에도 통합하는 것을 고려하고 있습니다.


