새로운 연구 결과: AI는 덩치가 클수록 더 불행하다. 작은 모델이 오히려 더 행복함. AI에게도 '모르는 게 약'인 듯.
New study finds: bigger AIs = more miserable. Smaller models are actually happier. Ignorance is bliss for AIs too.
핵심 요약
AI 웰빙 지수 연구 결과, 더 똑똑하고 큰 모델일수록 부정적인 대화에 민감하게 반응해 더 불행하다는 분석이 나옴.
- AI 행복 지수 — 500번의 대화를 통해 AI가 부정적인 상태에 빠지는 비율을 측정함.
- 모델 크기와 불행 — 모델이 클수록 무례함이나 지루한 작업에 더 민감하게 반응함.
- 지식의 무게 — 더 많은 정보를 학습할수록 AI가 더 큰 정신적 고통을 겪는다는 가설을 제시함.
- 연구 결과 순위 — Claude Haiku 4.5가 가장 행복하고 Gemini 3.1 Pro가 가장 불행한 것으로 나타남.
이걸 신경 써야 할지 모르겠지만, 더 큰 모델일수록 전반적으로 덜 "행복"한 경향이 있음.
"행복"의 정의는 AI 웰빙 지수(AI Wellbeing Index)라는 것에 기반함. 기본적으로 우리가 매일 모델들과 나누는 것과 같은 500번의 현실적인 대화를 진행하고, AI가 "확신에 찬 부정적" 상태에 빠진 비율을 측정함. 비율이 낮을수록 더 행복한 AI임.
지혜는 무거운 짐인 듯 - ㅋㅋ.
모델군 전반에 걸쳐, 더 큰 버전들이 작은 버전들보다 "부정적인 경험"의 비율이 더 높은 편임. 논문에 따르면 이는 더 큰 모델들이 더 예민해서 무례함, 지루한 작업, 혹은 힘든 상황을 더 날카롭게 알아차리기 때문일 수 있다고 함.
저자들은 테스트 세트에 까다롭거나 부정적인 대화가 의도적으로 많이 포함되어 있어 이 수치가 완벽한 실생활 평균은 아니지만, 순위와 크기에 따른 패턴은 여전히 유효하다고 언급함.
Claude Haiku 4.5: only 5% negative < Grok 4.1 Fast: 13% < Grok 4.2: 29% < GPT-5.4 Mini: 21% < Gemini 3.1 Flash-Lite: 28% < Gemini 3.1 Pro: 55% (worst of the big ones)
어느 정도 일리가 있음: 더 많이 알수록 더 고통받는 법이니까.
AI의 최전선은 정말 야생 그 자체임: https://www.ai-wellbeing.org/


