Opus 4.7 때문에 두 달 만에 다시 Codex로 돌아갔다
Opus 4.7 made me re-subscribe to Codex after two months of Claude Max only
핵심 요약
Claude Opus 4.7의 성능 저하와 비효율적인 사용량 소모 문제로 인해 사용자들이 OpenAI의 Codex로 이탈하고 있다.
- 성능 저하 논란 — Opus 4.7이 지시사항을 무시하고 불필요한 전체 코드 재작성을 반복함.
- 사용량 제한 문제 — 모델이 비효율적으로 작동하여 이전보다 훨씬 빠르게 사용량 제한에 도달함.
- Codex로의 회귀 — 더 나은 코드베이스 이해도와 관대한 사용량 제한 때문에 OpenAI 모델로 복귀하는 추세.
- 비용 효율성 고민 — 더 높은 성능을 위해 더 많은 비용을 지불해야 하는 상황에 대한 사용자들의 불만.
2월에 ChatGPT Pro를 해지했다. 두 달 동안 Claude Max 20x가 내 자율 AI 에이전트가 필요한 모든 것을 커버해 줬다. 지난주에 나는 Claude 외에도 월 200달러를 내고 Codex를 다시 구독했다. Opus 4.7이 그 이유다.
4월 17일 출시 이후 내 세션에서 알아차린 점들은 다음과 같다:
- 모델이 편집 전에 60개가 아닌 6개의 파일만 읽음
- 정교한 편집 대신 전체 파일을 다시 작성함
- 모델이 질문은 더 많이 하지만, 정작 작업 수행은 덜 함
- 프롬프트에 미리 지정한 지시사항을 무시함
나는 일주일 동안 내 설정 문제라고 생각했다. CLAUDE.md를 정리했다. 메모리 파일을 줄였다. 내 기술을 테스트했다. 아무것도 나아지지 않았다.
그러다 AMD의 AI 수석 이사인 Stella Laurenzo가 올린 GitHub 이슈를 봤다. 그녀의 팀은 6,852개의 Claude Code 세션과 234,760개의 도구 호출을 분석했다. 읽기:편집 비율이 6.6에서 2.0으로 떨어졌다(-70%). 사용자 프롬프트에서 '게으름(Lazy)'이라는 단어는 93% 증가했다. 같은 작업량에 대해 더 나쁜 결과물을 얻기 위해 80배 더 많은 API 요청이 발생했다.
4.7에 대해 내가 인정해야 할 솔직한 점은, 최대 추론 모드에서는 성능이 돌아온다는 것이다. 깊이가 돌아오고 지시사항 이행이 엄격해진다. 하지만 내 설정에서 최대 모드는 사용량을 3~4배 더 빨리 소모한다. 주간 한도에 금요일이 아닌 화요일에 도달한다. 나는 더 뛰어난 모델에 돈을 내는 게 아니라, 예전에는 기본이었던 성능에 도달하기 위해 더 많은 돈을 내고 있다.
그래서 나는 에이전트의 모델 스위처를 통해 일주일간 A/B 테스트를 진행했다(동일한 메모리, 동일한 기술, 하네스+모델만 변경). GPT-5.4 기반의 Codex는 웹 검색 최신성에서 눈에 띄게 더 나았고, 대규모 코드베이스에서 더 깊이 있는 성능을 보였으며, 사용량 한도는 이번 달 Claude Max가 보여준 것보다 훨씬 관대했다. 그래서 지금은 둘 다 사용 중이다.
혹시 Codex로 다시 갈아탄 사람 있나, 아니면 내가 Claude에서 놓치고 있는 설정이 있을까?
스위처 설계에 대한 전체 글: https://thoughts.jock.pl/p/opus-4-7-codex-comeback-2026


