알림: Codex 캐시 유지 시간은 최대 30분입니다
PSA: Codex cache only lasts max 30 minutes
핵심 요약
Codex의 캐시 유지 시간이 최대 30분으로 단축되어, 이전 모델보다 비용 효율성이 크게 떨어졌다는 분석입니다.
- 캐시 유지 시간 — 최대 30분으로 단축되어 작업 중단 시 비용 부담 증가함
- 비용 효율성 — 캐시 미스 발생 시 10배 높은 입력 비용이 청구됨
- 사용자 제어 — 캐시를 수동으로 유지하거나 관리할 수 있는 기능이 부재함
- 모델별 차이 — 모델과 서비스 환경에 따라 캐시 정책이 다르게 적용됨
GPT-5.6이랑 GPT-6 모델은 tibotattle.com 커뮤니티에서 300만 번의 대화를 분석해 본 결과, 캐시 유지 시간이 길어야 30분밖에 안 됨. 이게 무슨 뜻이냐면, 스레드 중간에 잠깐 쉬거나, 하던 일을 바꾸거나, 아니면 점심 먹으러 갔다 오기만 해도, 모든 스레드에서 캐시 안 된 입력값에 대해 10배 비용을 그대로 다 처맞게 된다는 소리임.
우리 중 많은 사람이 GPT-5.4나 GPT-5.5의 캐시 성능에 익숙해져 있었는데, 그때는 대충 6시간에서 24시간 정도는 버텼거든.


