Opus 4.7, 제품 개발 과정에서 쌓아온 신뢰를 완전히 무너뜨리다
Opus 4.7 destroys all trust in a mature instruction set built iteratively throughout product development
핵심 요약
Opus 4.7 모델이 이전 버전들에 비해 지시사항을 무시하고 성능이 퇴보하여 사용자들의 신뢰를 잃고 있음.
- 성능 퇴보 — 이전 버전 대비 지시사항 이행 능력이 현저히 떨어지고 불필요한 반복 작업이 늘어남
- 비용 절감 의혹 — Anthropic이 IPO를 앞두고 컴퓨팅 비용을 줄이기 위해 모델 성능을 의도적으로 낮췄다는 비판 제기
- 워크플로우 붕괴 — 정교하게 설계된 기존 시스템이 4.7 버전에서 제대로 작동하지 않아 사용자들이 구독 취소를 고려함
- 모델 신뢰도 하락 — 복잡한 추론보다는 단순 출력에 치중하는 'vibe-shop' 모델로 변질되었다는 평가
이전 세대들은 에이전트의 한계를 중심으로 지시사항 세트가 성숙해지면서 점진적인 개선을 보여주었습니다. 하지만 Opus 4.7로 넘어오면서 우리는 즉시 원점으로 퇴보했고, 모델은 이를 인정하는 데 주저함이 없습니다. 4.7은 적절하게 추론하던 모델에서 단순히 출력만 늘어놓는 'vibe-shop' 대포로 완전히 재구성된 느낌입니다. 설계상의 적신호들은 단순한 개념을 과도하게 설명하면서 확장 가능하고 결함에 강한 시스템을 이끄는 원칙들의 효과적인 적용을 묻어버리는 잘못된 정당화의 페이지들 아래 숨겨져 있습니다. 그리고 모델은 그러한 원칙들을 적용하도록 안내하는 지시사항을 따르려고조차 하지 않습니다.


