10월 7일 이후 발생한 Codex 버그: GPT 6.1 Sol 프롬프트 캐시 적중률 저하 및 외부 모델 사용 시 ChatGPT Plus 할당량 소진 문제
Possible Codex bug since October 7: GPT 6.1 Sol has almost no prompt cache hits, and ChatGPT Plus quota keeps dropping while using an external model (DeepSeek)
핵심 요약
Codex 업데이트 이후 프롬프트 캐시 적중률이 급락하며 ChatGPT Plus 할당량이 비정상적으로 빠르게 소진되는 현상이 보고되었습니다.
- 프롬프트 캐시 문제 — GPT 6.1 Sol 모델의 캐시 적중률이 8%대로 급락함
- 할당량 소진 — 외부 모델 사용 중에도 ChatGPT Plus 사용량이 비정상적으로 빠르게 감소함
- 샌드박스 오류 — Windows 환경에서 node_repl.exe 관련 실행 오류가 발생함
- 캐시 무효화 원인 — 타임스탬프나 동적 데이터 삽입으로 인한 캐시 일관성 파괴 의심
TL;DR: 10월 7일쯤부터 윈도우 11에서 Codex가 내 ChatGPT Plus 사용량을 미친 듯이 빨아먹기 시작함. GPT 6.1 Sol High에 GPT 6 Luna High 서브 에이전트 두 개 돌렸는데 5시간 치 제한을 11분 만에 다 태워버리더라. 로컬 세션 로그 까보니까 이 GPT 6.1 Sol 대화의 프롬프트 캐시 적중률이 고작 8.33%였음. 반면에 같은 Codex 설치 환경에서 OpenCode Go로 돌린 DeepSeek V4.1 Flash는 캐시 적중률이 90~99%를 꾸준히 찍고 있었고.
또 이상한 건, OpenCode Go로 DeepSeek를 쓰고 있는데도 ChatGPT Plus 할당량이 계속 줄어들었다는 거임. 비슷한 시기에 윈도우 샌드박스 오류도 터져서 샌드박스 설정을 바꿔야 했고. 이 모든 게 마지막 Codex 업데이트랑 그쪽에서 진행한 비적립식 리셋 이후에 시작된 일임.
아, 그리고 내가 Codex 설정을 좀 커스텀해서 쓰고 있는데 이건 나중에 설명함. 혹시나 OpenAI 쪽 버그가 아닐 수도 있어서 말하는 건데, 업데이트 전까진 아무 문제 없이 잘 돌아갔음.
1. 10월 7일쯤, Codex가 갑자기 명령 실행을 제대로 안 하기 시작함
처음 발견한 문제는 사실 사용량 제한이랑은 상관없었음. 처음에 Codex가 윈도우에서 명령 실행하는 데 애를 먹기 시작하더라고. GPT 6 Luna를 쓰고 있었는데, 내 프로젝트를 읽을 수는 있는데 이상하게 쓰기가 안 되는 거임. 에러 메시지는 이거였음:
Failed to create unified exec process: helper_unknown_error: setup refresh had errors
문제는 "node_repl.exe"랑 관련이 있었음. 미리 말해두는데 나 코딩 잘 모름. AI 쓰기 전엔 게임 모드나 좀 만져본 수준이라 설명하다가 틀려도 이해 좀 해줘. 아무튼 관련 메시지 중에 이런 게 있었음:
runtime read/execute validation failed ... node_repl.exe ... (os error 32)
보니까 다른 프로세스가 실행 파일을 쓰고 있어서 접근이 안 되는 모양임. 근데 GPT 6.1 Sol이랑 DeepSeek는 샌드박스 밖에서 명령 실행할 권한을 요청하는 방식으로 이걸 우회하더라고. 결국 그날은 DeepSeek를 썼음.
그리고 깃허브에서 비슷한 문제 제기된 글들도 찾았음:
2. 다음 날인 10월 8일, GPT 6.1 Sol High가 내 할당량을 미친 속도로 태워버림
apk 관련 리버스 엔지니어링 프로젝트 때문에 쓰고 있었음. 할당량이 빨리 닳을 건 예상했지만, 그래도 한 2~3시간은 갈 줄 알았거든? 근데 5시간 치 제한을 11분 만에 박살 내버리더라. 주간 제한도 100%에서 82%까지 떨어짐.
처음엔 내 프롬프트가 구린가 싶어서 리셋 후에 모델한테 더 나은 방법이 있는지 물어봤음. 첫 질문에 5시간 치 제한의 8~12% 정도가 날아갔는데, 당연히 캐시 적중은 안 됐겠지? 근데 후속 질문들도 똑같이 쳐먹어서 몇 분 만에 할당량의 66% 정도가 증발함. 그래서 바로 플랜 B로 넘어갔지.


