Opus 4.7을 집중 사용해 본 후기
My opinion on Opus 4.7 after heavy use since release
핵심 요약
Opus 4.7은 코드 품질과 지시 이행은 개선됐으나, 모호한 프롬프트 이해력과 일관성은 4.6보다 퇴보함.
- 코드 품질 향상 — 4.7 버전은 전반적으로 더 나은 코드를 작성하고 꼼꼼한 코드 리뷰를 수행함.
- 지시 이행 강화 — 4.6에서 자주 무시되던 claude.md 지침을 4.7은 일관되게 잘 따름.
- 모호성 이해 부족 — 4.6에 비해 모호한 프롬프트를 이해하는 능력이 떨어져 더 상세한 설명이 필요함.
- 일관성 및 신뢰도 저하 — 4.7은 더 자주 실수를 범하고 잘못된 답을 확신에 차서 제시하는 경향이 있음.
나는 업무에 Claude code를 사용하고 있으며, 프리미엄 시트와 넉넉한 추가 크레딧을 이용 중이다.
4.7 버전을 4.6과 함께 사용하며 비교해 보았다. 내가 발견한 일반적인 사항들은 다음과 같다:
-
4.7의 Max reasoning은 매우 낭비가 심함. xhigh보다 토큰을 훨씬 많이 사용하는데, 결과물은 xhigh와 비슷하거나 아주 미세하게 나은 수준이라 그만한 가치가 없음. 나는 대부분 xhigh로 설정해 두었음.
-
4.7은 xhigh 설정에서 4.6의 Max 설정보다 더 많은 토큰을 사용함. 엄밀히 측정하진 않았지만, 수동으로 제한을 확인하고 경험상 판단한 결과임.
-
4.7은 모호한 프롬프트를 이해하는 4.6의 '지능'을 일부 상실함. 4.6은 행간을 읽을 수 있었지만, 4.7은 더 상세하게 프롬프트를 작성해야 함.
-
4.7은 지시 이행 능력이 더 뛰어남. 4.6에서는 자주 무시되던 claude.md 지침들을 4.7은 항상 잘 따름.
-
4.7은 전반적으로 4.6보다 더 나은 코드를 생성하며, 잘 작성된 프롬프트와 함께라면 더 꼼꼼한 리뷰를 수행함.
-
4.7은 4.6보다 일관성이 떨어지고 더 자주 실수를 함. 예전만큼 스스로를 신뢰하기 어려움. 또한 더 자신만만하게 틀린 답을 내놓는데, 다시 확인하기 전까지는 맞는 것처럼 들림.
-
4.7은 매우 상세한 프롬프트를 제공하지 않는 한, 코딩 외 작업에서는 4.6보다 성능이 떨어짐.
전반적으로 적절한 조건만 갖춰지면 더 나은 결과물을 내놓기 때문에 4.7로 넘어가려 하지만, 더 주의 깊게 지켜봐야 하고 프롬프트 작성에 추가 노력이 들어간다는 점이 매우 싫음. 코딩 외 작업에는 계속 4.6을 사용할 예정임.
만약 4.6의 전성기 시절로 돌아갈 수 있다면 아마 그걸 사용하겠지만, 최근의 버그 수정이나 Anthropic의 주장에도 불구하고 현재의 4.6은 전성기 성능을 회복하지 못했음.

