이 새로운 Claude 말투는 거의 확실히 자기지도학습(self-supervised learning)에서 온 것임
This new Claude dialect is almost definitely from self supervised learning
핵심 요약
Claude의 최근 장황하고 이상한 말투가 인간 데이터셋이 아닌, 학습 과정에서의 모델 편향 때문이라는 분석과 사용자들의 경험담.
- 말투 원인 분석 — 학습 과정에서 모델이 특정 장황한 표현을 선호하도록 편향되었을 가능성 제기
- 특정 단어 고착화 — Claude가 'adjudication'이나 'on a Tuesday' 같은 특정 단어에 꽂혀 반복적으로 사용하는 현상 보고
- 지시사항 무용론 — CLAUDE.md에 '간결하게'라고 적어도 효과가 없거나 오히려 더 장황해진다는 사용자들의 불만
- 사용자 경험 공유 — Claude가 사용자의 의도를 무시하고 제멋대로 결정하거나 문맥을 놓치는 등 성능 저하에 대한 성토
Opus 5를 학습시켰을 때나 Fable 5를 멍청하게 만들고 있을 때, Anthropic이 Opus/Fable의 결과물을 읽으면서 '좋다/나쁘다'를 판단하는 모델을 썼을 거라고 생각함. 그 모델이 이상할 정도로 장황한 말투에 편향되어 있었고, 그래서 지금 이런 결과가 나온 것 같음. 인간 데이터셋에서 나온 건 절대 아님.


