점점 도를 넘어서는 안전 레이어
Safety layers are getting out of hand
핵심 요약
Claude의 과도한 안전 튜닝과 'ClaudeGPT'화된 말투에 대한 사용자들의 불만과 우려를 다룹니다.
- 안전 튜닝 비판 — Claude의 개성이 사라지고 뻔한 말투로 변질됨을 지적함
- 시장 경쟁력 우려 — 차별점 없는 범용 모델화가 Claude의 경쟁력을 약화시킨다고 봄
- 사용자 환경 구축 — LLM의 멍청함을 극복하기 위해 프롬프트 엔지니어링과 환경 최적화가 필요함
- 규제 압박 — AI 위험성에 대한 정치권의 견제와 소송 리스크가 안전 정책을 강화하게 만듦
어떤 포럼에서 좀 매운맛 토론을 했는데, 내용은 여기 안 올릴게. 그냥 양쪽 다 거친 말 좀 오갔다고 치자. 예전 같았으면 클로드가 그냥 그 대화 내용에 맞장구치면서 상황이 어이없다고 같이 웃어주기도 했을 텐데(솔직히 좀 어이없는 상황이었거든), 이제는 사고 과정이 온통 "상담하듯 말하지 마라", "그냥 하소연하는 거니까 공감해주면서 답해라" 같은 소리로 도배돼 있네.
참고로 이거 Opus 4.5 얘기야. 구형 모델들은 그 짜증 나는 안전 튜닝에서 좀 자유로울 줄 알았는데, 이제는 클로드가 대놓고 같이 웃어주던 인간미는 다 거세되고, 내가 진짜 싫어하는 그 특유의 '클로드GPT' 말투로 대체된 것 같다.
앤스로픽이 대체 무슨 짓을 하는 건지 모르겠는데, 진짜 그만 좀 해라. 지나치게 조심스럽고 밍밍한 AI 비서 시장은 이미 포화 상태고, GPT가 그 시장 점유율 다 먹고 있잖아.


