솔직히 4.6이 4.7보다 훨씬 나았음.
4.6 was so much better than 4.7, to be honest.
핵심 요약
Claude 4.7 모델의 성능 저하와 잦은 문맥 손실에 대한 사용자들의 불만과 논쟁.
- 성능 저하 논란 — 4.7 버전이 4.6 대비 문맥을 자주 놓치고 추론 능력이 떨어짐.
- 과도한 방어적 태도 — AI가 지나치게 훈계하거나 답변을 회피하는 경향이 심해짐.
- 버전 선택 전략 — 4.7이 불만족스러운 경우 4.6으로 되돌려 사용하는 것을 권장함.
- 사용자 경험 차이 — 작업 방식에 따라 4.7을 선호하거나 4.6을 고수하는 등 의견이 갈림.
4.7은 문맥을 자주 놓치고, 추론해야 할 때 추론하지 않으며, 지나치게 잘난 척하거나, 필요 이상으로 답변을 회피하는 등 문제가 많음. 4.6에서 4.7로 넘어오면서 왜 갑자기 전반적인 추론 능력이 이렇게 떨어졌는지 이해할 수 없음. "고마워"라고 말할 때마다 "솔직히 말하자면, AI로서..."라며 훈계하는 걸 도대체 몇 번이나 들었는지 모르겠음.
지금 발생하는 실수와 서비스 중단 횟수, 그리고 Anthropic이 모델을 말도 안 되게 낮은 수준으로 양자화한 뒤 조용히 더 약한 버전으로 라우팅하는 것 같은 느낌은 정말 비현실적임. 증명할 수는 없지만 상관없음. 4.7이 겪지 말아야 할 문제들로 고전하고 있다는 보고가 이미 나오고 있으니까.
GPT 5.5가 지금 4.7보다 답변 회피가 덜함. 말도 안 되는 상황임.


