미안하다 Opus 5, 내가 널 과소평가했어
I'm sorry Opus 5, I underestimated you
핵심 요약
Opus 5의 성능에 대한 사용자들의 엇갈린 평가와 모델의 고질적인 지시 불이행 문제에 대한 토론.
- 모델 성능 논란 — Opus 5의 추론 능력은 뛰어나지만 지시를 무시하거나 게으른 태도를 보임
- 프롬프트 최적화 — 명확한 구조와 제약 조건을 설정하면 모델이 훨씬 더 잘 작동한다는 의견
- 사용자 경험 차이 — 개발 환경에 따라 모델의 일관성이 떨어지고 환각 현상이 발생한다는 비판
- 시스템 가이드라인 — Anthropic의 권장 사항이 복잡한 프로젝트에는 적용하기 어렵다는 지적
다시 말하지만, 내가 제일 먼저 불평했을 때 팬보이들이 전부 비추를 눌렀었지. 이제 Opus 5를 싫어하는 사람들이 늘어나는 걸 보니 똑같은 상황이 올 것 같네 ㅋㅋ
Opus 4.8이나 Sol을 적대적 리뷰어로 써서 적절한 컨텍스트로 제대로 쥐어짜면, 이 녀석이 보여주는 추론 수준은 정말 인상적이야. 그렇다고 해서 이 녀석이 지시를 따르지 않거나 아예 읽지도 않을 정도로 게으르다는 사실이 부정되는 건 아니지. 마치 감독 없이는 아무것도 못 하는 심각한 ADHD를 가진 초천재 아이들 같아.


