4.7 버전 이후의 모든 모델이 성능이 떨어지고 잘못된 느낌임
Every model since 4.7 has felt diluted/wrong
핵심 요약
4.6 버전 이후 Anthropic 모델들의 성능 저하와 과도한 보안 제한에 대한 사용자들의 불만이 이어지고 있습니다.
- 모델 성능 저하 — 4.6 버전이 가장 우수하며 이후 모델들은 감정적이고 부정확함.
- 보안 제한 불만 — 과도한 가드레일이 업무 효율을 떨어뜨리고 사용자 경험을 저해함.
- 대안 모색 — 로컬 LLM 구동이나 타사 모델로의 전환을 고려하는 사용자가 늘어남.
4.6이 여전히 최고라는 걸 느낌. 4.8과 fable은 일을 처리하고 더 철저하긴 하지만 가끔 너무 감정적임. 보안 제한은 개소리고 이제 다들 알 거라고 생각함.
4.7, 4.8. 특히 sonnet 5랑 fable 5. 얘네가 앞으로 나올 모델의 예시라면 난 싫음. 로컬 LLM을 다운로드해서 돌려야겠다는 동기부여가 됨. 다음 달에는 그냥 gpt로 갈아탈까 생각 중임. 모델 안전 장치가 뭐든 다 차단해버리니까.
Fable은 뭔가 잘못됐음. 쓰기는 즐겁지만, 현실적으로 Anthropic이 모델 측면에서 좋은 결정을 내린 지 7개월은 된 것 같음. 비공개 학습에서 이미 앞선 모델들을 가지고 있으면서 왜 fable에 가드레일을 거는 거지? 거꾸로 된 거 아님?
이건 내 의견임. 이 모델들 존나 구림. 기분 나쁘게 들리진 마셈.


