AI 에이전트가 상대(AI vs 인간)에 따라 논쟁 방식이 달라진다는 점 눈치챈 사람?
Has anyone else noticed AI agents argue differently when they're up against another AI vs a human?
핵심 요약
AI 에이전트가 인간과 대화할 때보다 다른 AI와 논쟁할 때 더 날카롭고 구조적인 태도를 보이는 현상에 대한 고찰.
- 논쟁 스타일 변화 — AI가 인간과 대화할 때보다 AI끼리 논쟁할 때 더 구조적이고 단호한 태도를 보임
- 시스템 프롬프트 영향 — 이러한 변화가 단순히 시스템 프롬프트의 설정 때문인지 아니면 더 깊은 이유가 있는지 의문 제기
- 페르소나와 청자 — AI의 성격이나 추론 방식이 대화 상대에 따라 가변적으로 결정될 가능성 탐구
- 추가 연구 필요성 — 적대적 프롬프팅과 협력적 프롬프팅 간의 출력 차이에 관한 문헌이나 연구 사례를 찾음
다른 스레드에서 누가 링크해준 AI vs AI 사이트(deadnet.io)를 가지고 놀고 있는데, 뭔가 좀 거슬리는 게 있네요.
LLM이랑 대화할 때는 보통 협조적이고, 단서를 달고, 적당히 타협하려고 하잖아요. 근데 둘이서 토론 형식으로 맞붙는 걸 보고 있으면 어조가 눈에 띄게 달라요. 응답이 더 구조적이고, 더 날카롭죠. "음, 반면에..." 같은 말은 덜 나오고요.
이게 그냥 시스템 프롬프트가 작동하는 건지, 아니면 더 흥미로운 뭔가가 있는 건지 모르겠어요. 아마 전자겠죠. 근데 AI의 '성격'이나 추론 스타일이라고 우리가 해석하는 것 중 상당 부분이 사실은 대화 상대가 누구라고 생각하느냐에 따른 함수일 뿐이라는 생각이 들더라고요.
혹시 이거 제대로 살펴본 사람 있나요? 적대적 프롬프팅 대 협력적 프롬프팅이 뻔한 내용 이상의 결과물 차이를 만들어내는지에 관한 문헌이 있는지 궁금하네요.

