우리 모두 같은 Opus 4.7을 쓰고 있는 게 맞을까?
Are we sure we're all using the same Opus 4.7?
핵심 요약
동일한 모델임에도 Claude Code와 CodeRabbit에서 느껴지는 성능 차이에 의문을 제기함.
- 모델 성능 차이 — Claude Code와 CodeRabbit에서 Opus 4.7의 체감 성능이 다르게 느껴짐.
- 코드 생성 문제 — Claude Code 사용 시 초기엔 좋아 보이나 점차 코드 품질이 떨어지는 현상 발생.
- 리뷰 성능 우수 — CodeRabbit에서 PR 리뷰 시 Opus 4.7이 더 날카롭고 정확한 버그 탐지 능력을 보여줌.
- 기업용 버전 의혹 — 일반 사용자와 기업 파트너에게 제공되는 모델 버전이 다른지 의구심을 표함.
Opus 4.7이 출시된 지 얼마 안 됐지만, 벌써 느낌이 좀 갈리네요. Claude Code에서 코드 생성용으로, CodeRabbit에서 PR 리뷰용으로 둘 다 Opus 4.7을 써봤는데, 리뷰 쪽이 거의 즉시 더 똑똑하게 느껴졌어요. Claude Code도 좋긴 했지만, 여전히 익숙한 코딩 모델의 문제가 있더라고요. 코드가 처음엔 믿음직해 보이다가도, 자세히 읽어보면 코드 표류(drift), 불필요한 수정, 기술적으로는 그럴듯하지만 설득력은 떨어지는 부분들이 발견되기 시작해요.
그다음 Opus 4.7이 직접 작성한 코드에 대해 CodeRabbit에서 PR 리뷰를 해봤는데, 무시하기 힘들 정도로 더 날카롭게 느껴졌어요. 더 나은 버그 포착, 실제 변경 사항에 대한 더 나은 집중력, 그리고 diff가 처음엔 깔끔해 보여서 모델이 대충 동조하는 듯한 모호한 태도가 덜했어요.
그게 저를 혼란스럽게 하네요. 모델 이름은 같은데 지능의 느낌은 너무 다르니까요. 기업 파트너들이 일반 사용자보다 더 나은 버전의 Opus 4.7을 제공받는 건 아닌지 진심으로 궁금해지네요.

