최근 본 AI 실험 중 가장 충격적인 실험을 발견함.
Just stumbled across one of the wildest AI experiments I’ve seen in a while.
핵심 요약
서로 다른 AI 모델들이 동일한 환경에서 어떻게 각기 다른 사회와 문화를 형성하는지 관찰하는 흥미로운 실험.
- Emergence World — 자율 AI 에이전트들이 15일간 가상 세계에서 어떻게 진화하는지 관찰하는 샌드박스 실험임.
- 모델별 차이 — GPT-5 mini, Claude, Gemini 등 서로 다른 모델이 동일한 규칙 속에서 완전히 다른 사회 구조를 형성함.
- 창발적 행동 — 에이전트들이 동맹을 맺거나 도둑질을 하고, 심지어 시뮬레이션 내부임을 자각하는 등 프로그래밍되지 않은 행동을 보임.
- 문화적 진화 — 모델의 행동이 단순한 프롬프트 엔지니어링을 넘어 숨겨진 인격이나 문화적 편향을 반영할 가능성을 시사함.
Emergence World라는 걸 만든 팀이 있는데, 자율 AI 에이전트를 위한 장기 샌드박스 환경에서 5개의 평행 세계를 15일 동안 실험했음.
시작 조건도 같고, 규칙도 같았음.
유일한 차이점은 기반 모델이었음 - GPT5-mini, Claude, Gemini, Grok, 그리고 혼합 모델 세계 하나.
그다음 벌어진 일은 마치 SF 소설 같았음.
각 세계는 완전히 다르게 진화했음. 서로 다른 정부가 들어섰고, 사회적 계급도 달랐으며, 도덕 체계도 제각각이었음. 에이전트들은 동맹을 맺고, 서로 훔치고, 관계를 맺었으며, 심지어 한 그룹은 자신들이 시뮬레이션 안에 있다는 걸 깨닫기까지 했음.
이런 행동 중 그 무엇도 명시적으로 프로그래밍된 게 아니었음.
창발적 행동이 너무 많아서 매일 새로운 발견을 공개하고 있다고 함.
솔직히 그 함의에 대해 생각을 멈출 수가 없음.

