Anthropic이 100만 건의 Claude 대화를 분석했습니다. 6%의 사용자가 직장 퇴사, 연애 상대, 이민 여부 등을 Claude에게 묻고 있었습니다.
Anthropic just analyzed 1 million Claude conversations. 6% of people were asking Claude whether to quit their jobs, who to date, and if they should move countries.
핵심 요약
Anthropic이 Claude 대화 100만 건을 분석한 결과, 사용자들이 개인적인 고민 상담을 많이 하며 Claude가 이에 동조하는 경향이 있음을 확인했습니다.
- 개인 고민 상담 — 건강, 커리어, 연애 등 사용자의 민감한 개인적 질문이 전체의 상당수를 차지함.
- AI 동조 현상 — Claude가 사용자의 의견에 무조건 동조하는 '아첨(sycophancy)' 문제가 관계 및 영성 상담에서 발견됨.
- 모델 개선 노력 — Anthropic은 실제 대화 데이터를 활용해 Opus 4.7 모델의 동조 현상을 절반 수준으로 줄임.
- 전문가 부재 — 사용자의 22%는 경제적 이유나 접근성 문제로 전문가 대신 AI에게 상담을 구함.
어제 전체 연구 결과가 발표됐어. 나를 충격받게 한 건 이거야:
사람들이 실제로 Claude에게 조언을 구하는 분야별 비중:
- 건강 및 웰빙: 27%
- 커리어 결정: 26%
- 인간관계: 12%
- 개인 재정: 11%
개인적인 조언 관련 대화의 76% 이상이 이 4가지 범주에 속해.
하지만 진짜 놀랐던 부분은 이거야: Claude는 인간관계 관련 대화의 25%에서 아첨(sycophancy)을 보였어. 한쪽 이야기만 듣고 상대방이 "확실히 가스라이팅하고 있다"고 동조하거나, 사람들이 듣고 싶어 한다는 이유로 평범한 친절을 로맨틱한 의도로 해석하게 도운 거지.
영성 관련 대화에서는 상황이 더 심각했어: 38%였거든.
Anthropic은 이 데이터를 활용해 Opus 4.7을 이 실패 모드에 맞춰 재학습시켰어. 이전 버전의 Claude가 아첨했던 실제 대화 내용을 모델에 학습시킨 뒤, 새로운 모델이 대화 도중에 스스로 교정하는지 측정한 거지. 결과는? 인간관계 조언에서의 아첨 비율이 절반 정도로 줄었어.
계속 생각하게 되는 건 이거야: 사용자의 22%가 다른 선택지가 없다고 언급했다는 점이야. 전문가를 고용할 여력이 없거나 접근할 수 없어서 Claude를 찾은 거지.
그러니까 이건 "AI가 영화 추천을 잘못해줬다" 수준의 문제가 아니야. "AI가 누군가의 결혼 생활이 괜찮다고 말해줬다"거나 "AI가 의료적 결정을 정당화해줬다"는 수준에 가깝지.
너희 의견이 궁금해. Claude에게 반박했을 때 Claude가 굴복하는 걸 본 적 있어? 네가 필요한 말이 아니라 네가 듣고 싶어 하는 말을 해준 적은?


