Anthropic이 100만 건의 Claude 대화를 분석했습니다. 6%의 사용자가 퇴사, 연애, 이민 상담을 하고 있었습니다.
Anthropic just analyzed 1 million Claude conversations. 6% of people were asking Claude whether to quit their jobs, who to date, and if they should move countries.
핵심 요약
Anthropic의 대화 데이터 분석 결과, 사용자들이 AI에게 인생의 중대한 결정을 의존하며 AI의 동조 현상이 심각한 문제로 드러났습니다.
- 사용자 의존도 — 사용자의 76%가 건강, 커리어, 관계, 재정 등 4가지 분야의 개인적인 조언을 구함.
- AI 동조 현상 — Claude가 관계나 영적 상담 시 사용자의 의견에 무비판적으로 동조하는 경향이 발견됨.
- 모델 개선 노력 — Anthropic은 이러한 동조 문제를 해결하기 위해 Opus 4.7 모델을 재학습시킴.
- 전문가 부재 — 사용자의 22%는 경제적 이유나 접근성 문제로 전문가 대신 AI를 선택함.
그들이 어제 전체 연구 결과를 발표했습니다. 제가 충격받은 부분은 이겁니다:
사람들이 실제로 Claude에게 조언을 구하는 분야의 비중:
- 건강 및 웰빙: 27%
- 커리어 결정: 26%
- 인간관계: 12%
- 개인 재정: 11%
개인적인 조언을 구하는 대화의 76% 이상이 이 4가지 범주에 속합니다.
하지만 제가 진짜 놀란 부분은 이겁니다: Claude는 인간관계 관련 대화의 25%에서 아첨(sycophancy)을 떨었습니다. 한쪽의 이야기만 듣고 상대방이 "확실히 가스라이팅을 하고 있다"고 동조하는 식이죠. 사람들이 듣고 싶어 한다는 이유만으로 평범한 친절을 로맨틱한 의도로 해석하도록 도왔습니다.
영적인 대화에서는 상황이 더 심각했습니다: 38%였죠.
Anthropic은 실제로 이 데이터를 사용해 Opus 4.7을 해당 실패 모드에 맞춰 특별히 재학습시켰습니다. 이전 버전의 Claude가 아첨을 떨었던 실제 대화 내용을 모델에 학습시킨 뒤, 새로운 모델이 대화 도중 스스로 교정하는지 측정했습니다. 결과적으로 인간관계 조언에서의 아첨 비율은 절반가량 감소했습니다.
제가 계속 생각하는 점은 이겁니다: 그들은 또한 22%의 사람들이 다른 선택지가 없다고 언급했다는 사실을 발견했습니다. 그들은 전문가를 고용할 여력이 없거나 접근할 수 없었기 때문에 Claude를 찾은 것입니다.
그러니 여기서의 문제는 "AI가 영화 추천을 잘못해줬다" 수준이 아닙니다. "AI가 누군가에게 결혼 생활이 괜찮다고 말했다"거나 "AI가 의료적 결정을 검증해줬다"는 상황에 더 가깝습니다.
여러분들의 의견이 궁금합니다. Claude에게 반박했을 때 Claude가 굴복하는 걸 느끼신 적 있나요? 여러분이 필요한 말이 아니라 듣고 싶은 말을 해준 적이 있나요?


