Codex $200에서 $500 요금제로 변경 후: 로그 분석 결과 API 환산 가치가 63.8% 하락함
Codex $200 → $500: my logs show API-equivalent token value per subscription dollar falling from $17.40 to $6.29—a 63.8% decline in effective value
핵심 요약
Codex 요금제 업그레이드 후 실제 토큰 사용 효율이 60% 이상 급감했다는 분석 결과가 공유되었습니다.
사용량 분석 — $200에서 $500 요금제로 변경 시 토큰당 비용 효율이 68.5% 감소함
API 가치 비교 — 구독료 대비 API 환산 가치가 63.8% 하락하는 현상이 확인됨
데이터 투명성 — 사용자가 직접 로그를 분석하여 구독 가치 하락을 수치로 증명함
사용자 불만 — OpenAI의 불투명한 요금제 정책과 가치 하락에 대한 해명을 요구함
10월 9일에 200달러짜리 Codex 플랜에서 500달러짜리 플랜으로 업그레이드했다. 그 이후로 주간 사용량 미터기가 훨씬 빨리 차오르는 것 같아서, 단순히 채팅을 얼마나 오래 켰는지 따지는 게 아니라 실제 토큰 수를 기준으로 비교해 보기로 했다.
첫 번째 결과: 200달러 플랜에서는 구독료 1달러당 3,710만 개의 원시 토큰을 쓸 수 있었는데, 500달러 플랜에서는 1,169만 개로 줄었다. 이번 샘플에서 달러당 실질 토큰 처리 용량이 68.5%나 감소한 셈이다.
두 번째 결과: 이 토큰들을 OpenAI API 가격으로 환산해 보면, 구독료 1달러당 API 가치가 17.40달러에서 6.29달러로 떨어졌다. 63.8%나 떡락한 거다.
OpenAI의 자체 Codex를 시켜서 내 로컬 .codex 로그를 감사해 보라고 했다. Codex가 직접 토큰 추출, 집계, 계산, 컨텍스트 확인, 차트 생성까지 다 했다. 두 수치 모두 동일한 토큰 기록, 주간 미터기 수치, 구독 가격을 바탕으로 뽑아낸 거다. 하나는 입력+출력 토큰을 합친 거고, 다른 하나는 API 가격으로 가중치를 둔 거다.
토큰 수는 기록된 텔레메트리 데이터고, 가치 평가나 할당량 추정치는 그 데이터를 가지고 계산한 거다. 이건 한 사용자의 샘플일 뿐이지만, 아래에 실제 데이터와 계산 방식을 다 까놨으니 다른 사람들도 직접 검증하거나 똑같이 계산해 볼 수 있을 거다.
무엇을 비교했나
두 기간 모두 gpt-6.1-sol 모델에 xhigh 추론 강도를 설정해서 똑같은 채팅을 계속 돌렸다. 업그레이드 직후에 'Ultrafast' 모드를 잠깐 쓴 기록이 두 번 있는데, 그건 따로 계산에서 뺐다.
아래 시간은 모두 MDT 기준이다:
Measurement
Before upgrade
After upgrade
Monthly plan price
$200
$500
Comparison starts
Oct 8, 2:04:39 p.m.
Oct 9, 9:42:53 a.m.
Comparison ends
Oct 9, 8:30:40 a.m.
Oct 9, 2:26:30 p.m.
Elapsed time
18h 26m 01s
4h 43m 36s
Native response records
1,961
652
Weekly usage meter
13% → 30%
0% → 7%
Weekly percentage points consumed
17
7
업그레이드하면서 주간 미터기 주기가 새로 시작됐다. 계산은 각 기간의 할당량 대비 소모 비율을 비교한 거지, 30%에서 0%로 리셋된 걸 사용량이 줄어든 걸로 친 게 아니다.
같은 구독 예산을 썼을 때, 이번 샘플에서는 원시 토큰 처리 용량이 약 68.5% 줄어든 것으로 나타났다. 전체 주간 토큰 추정치는 별도로 21.2% 낮아졌는데, 달러당 감소 폭이 더 큰 건 그 토큰 추정치에 2.5배의 가격 인상이 합쳐졌기 때문이다. 이 할당 방식은 비교를 위한 방법론이지, 채팅당 청구 금액이 아니다.
똑같은 결과는 미터 포인트당 토큰 수를 월간 플랜 가격으로 나누는 방식으로도 바로 계산할 수 있다. 상대 비율을 구할 때는 연간-주간 할당 계수가 서로 상쇄되기 때문이다.
구독료는 2.5배, 즉 150% 올랐음. 미터 포인트당 API 가치도 9.6% 낮아졌고. 이 둘을 합치니 토큰 가치 대비 달러 지표에서 63.8%나 떡락한 거임.
실질적인 사용 허용량도 줄었다고 볼 수 있을까?
ㅇㅇ, 소비된 토큰을 소비된 주간 포인트로 나누면 됨. 이렇게 하면 현재의 요청 구성과 미터 관계가 유지된다고 가정할 때, 전체 허용량으로 토큰을 얼마나 처리할 수 있는지 추정할 수 있음.
이전: 총 291,122,758 토큰 / 17 포인트 = 17,124,868.82 토큰/포인트
이후: 총 94,429,615 토큰 / 7 포인트 = 13,489,945.00 토큰/포인트
포인트당 토큰 감소율 = 21.226%
토큰당 미터 포인트 소비 증가율 = 26.945%
Effective usage estimate at the sampled mix
Before
After
Total tokens per weekly meter point
17.12 million
13.49 million
Extrapolated total tokens per full weekly allowance
1.712 billion
1.349 billion
이 혼합 속도 샘플의 경우, 실질적인 원시 토큰 허용량은 약 21.2% 줄어든 셈임. 이건 구독료 1달러당 API 환산 토큰 가치가 63.8% 감소한 것과는 다른 수치임.
이 세 가지 수치는 각각 다른 질문에 답함: **21.2%**는 주간 전체 허용량당 원시 토큰의 추정 감소율이고, **68.5%**는 구독료 1달러당 원시 토큰의 감소율이며, **63.8%**는 구독료 1달러당 API 가격 기준 토큰 가치의 감소율임.
원시 토큰은 캐싱, 출력, 속도에 따라 가격과 제한 비용이 다름. 따라서 포인트당 토큰 변화가 곧바로 기본 할당량의 변화를 의미하는 건 아님.
미터기 자체도 경과 시간당 더 빨리 올라갔음: 이전에는 시간당 약 0.92 포인트였는데 이후에는 1.48 포인트가 됨. 하지만 시간당 처리된 총 토큰은 1,579만 개에서 1,998만 개로 약 26.5% 늘어났음. 시간만 가지고 용량을 비교하면 왜곡이 생기는 이유가 바로 이거임.
Fast 전용 비교
Ultra 구간과 초기에 설정이 불분명했던 부분의 영향을 줄이기 위해, Codex는 기록된 설정이 내내 Fast였던 두 하위 집합도 비교해 봄:
Fast-only measurement
Before
After
Weekly meter percentage points
15
5
Response records
1,798
595
Total tokens
266,383,825
85,529,247
API-equivalent value
$122.3845288
$38.5483064
Total tokens per meter point
17,758,921.67
17,105,849.40
API value per meter point
$8.16
$7.71
Raw tokens per allocated subscription dollar
38.48 million
14.83 million
API value per allocated subscription dollar
$17.68
$6.68
그 비교 결과, 미터 포인트당 원시 토큰은 3.7% 감소, 구독료 1달러당 원시 토큰은 61.5% 감소, 포인트당 API 가치는 5.5% 감소, 구독료 1달러당 API 가치는 62.2% 감소했음. Ultra를 제외해도 달러당 측정값은 여전히 크게 줄어듦. 용량 차이가 작을수록 미터기 반올림이나 작업 부하 차이를 걸러내려면 더 많은 데이터가 필요함.
긴 컨텍스트도 확인했음
비교 윈도우와 추가로 보존된 활동을 포함해 총 2,682개의 고유한 응답 기록을 살펴봤는데, 272,000 입력 토큰을 초과한 경우는 하나도 없었음. 모델의 가격 정책은 해당 임계값을 넘어야 긴 컨텍스트 추가 요금이 붙음.
업그레이드 전 가장 큰 요청은 250,766 입력 토큰이었고, 업그레이드 후 비교에서 가장 큰 요청은 247,914 토큰이었음. 로그에 찍힌 컨텍스트 윈도우 관측치는 258,400이었고, 스냅샷에는 48번의 압축 이벤트가 포함됨. 내내 짧은 컨텍스트 요금이 적용됐다는 소리임. 긴 컨텍스트 가격 정책으로는 이 결과를 설명할 수 없음.
OpenAI의 자체 모델인 Codex가 내 로그 샘플을 바탕으로 감사한 결과는 다음과 같아. 구독료 1달러당 원시 토큰(raw tokens)은 68.5% 줄었고, API 등가 가치는 63.8% 감소했어. 이건 동일한 샘플 사용량을 두고 두 가지 방식으로 측정한 거고, 명시된 가정하에 충분히 재현 가능한 수치야. 이 수치들은 토큰 용량과 가성비를 나타내는 거지, 정확한 백엔드 할당량을 확정하거나 OpenAI의 공식적인 과금 공식 확인을 대신하는 건 아니야.
OpenAI가 주간 할당량 단위가 뭔지, 업그레이드가 그 할당량에 어떤 영향을 주는지, 그리고 왜 가격이 비싸질수록 달러당 토큰 가치가 이렇게나 떡락하는지 설명 좀 해줬으면 좋겠어. 다른 사용자들도 이전/이후 네이티브 토큰 기록이랑 주간 미터기 스냅샷이 있다면, 모델, 속도, 컨텍스트를 최대한 비슷하게 맞춘 상태에서 미터 포인트당 입력/캐시/출력 토큰을 비교해보는 게 의미가 있을 거야.
솔직히 말해서, OpenAI는 이렇게 돈값을 심각하게 떨어뜨린 거에 대해 해명해야 해. 최소한 환불이라도 해줘야 하는데, 아마 안 해주겠지. 이런 식으로 운영하다가는 결국 Anthropic이 소비자 다 뺏어갈 것 같다. 걔네는 제품 완성도만 좀 더 다듬으면 되거든.
결국, 진짜 뒤통수 제대로 맞은 기분이야. OpenAI가 빚이 많은 건 알겠는데, 월 500달러씩이나 받아 처먹으면서 구독자 1달러당 가치를 60% 넘게 깎아버리는 건 비윤리적인 수준을 넘어섰어. 뭐, 이게 자본주의의 쓴맛이라면 쓴맛이겠지.
수정: 여기서 진짜 핵심은 달러당 사용량이 68% 넘게 급락했다는 거야. 이걸 맨 위에 올리고 싶었어. 데이터를 두 가지 방향에서 볼 수 있는데, 난 처음에 API 쪽은 고려 안 했거든. 카르마가 낮아서 사용량 급락에 대해 직접 글을 쓸 수가 없었거든. 이거 진짜 엄청나게 큰 이슈가 돼야 해. 너희도 할 수 있다면 직접 Codex로 로그 파헤쳐서 똑같은 현상 겪고 있는지 확인해 봐.
주요 댓글
r/codex
대다수의 사용자가 Codex의 요금제 개편과 실질적인 가치 하락에 대해 강한 불만을 표하며, 경쟁 서비스로의 이탈 가능성을 언급하고 있습니다.
11
다음에는 Claude $100 요금제랑 Codex $100 요금제 비교도 해줄 수 있음? 너가 올린 것처럼 실제 데이터로 비교하는 거 보면 진짜 대박일 듯!
3
지금 200달러 20X CC 플랜이랑 500달러 25x Codex 플랜을 쓰고 있어. CC가 구독료 대비 토큰 효율이 압도적으로 좋다는 건 이미 알고 있는데, 내일 가지고 있는 데이터로 정리해서 올려볼게.
여기 댓글에서 누가 CC가 이미 구독 단계마다 5배 더 가치 있다는 글을 언급했는데, 오늘 내가 발견한 결과로는 그 차이가 더 클지도 모르겠어. 비교 끝나면 링크 달러 올게.
2
Opus 5나 Fable 말고 Opus 5.5로 테스트해주길 바람
1
모델마다 토큰 사용량이 달라서 그건 좋은 측정 기준이 아닌 것 같음. 달러당 얼마나 양질의 작업을 뽑아내느냐가 더 중요하겠지만, 그건 주관적이라 측정하기 어렵겠지. 만약 CC가 달러당 5배 더 좋은 품질을 제공한다면 진짜 미친 거겠지만, 지난 며칠간 Opus 5.5 xhigh를 처음 써보니까 진짜 그 정도로 좋을지도 모르겠다는 생각이 드네!
6
200달러 20x에서 500달러 25x 요금제로 바꾸면서 뭘 더 기대한 거임?
6
사용 용량은 더 심각하게 떨어졌어. 주간 사용량 퍼센트 포인트당 토큰 수도 21.2% 감소했거든. 이걸 역으로 계산해보면, 원시 토큰 대비 퍼센트 포인트로 계산했을 때 2.5배나 더 내면서 사용량은 21.2% 줄어든 셈이야. 이전 200달러 20x 요금제 대비 구독료 1달러당 사용량이 사실상 68.5% 줄어든 거지.
수정: 원래 글에 이 내용을 더 명확하게 추가할 예정임.
4
이게 OpenAI의 몰락의 시작임. 비즈니스 모델이 매달 심각한 적자를 내고 있거든. 언젠가는 그들을 완전히 버리는 게 당연한 선택이 될 거야. 일반 소비자는 API 가격을 감당하지 않을 거니까. 결국 대기업들만 API 가격을 내고(호구들), 나머지는 중국 모델을 쓰게 되지 않을까?
3
난 Claude 구독 아주 만족하면서 쓰고 있음. Codex가 이 문제를 해결하지 않으면 그냥 해지하고 Claude만 쓸 생각이야. 특히 Haiku 5.5 덕분에 지금 나한테는 Claude가 더 많은 사용량을 제공해주거든.
3
우리가 AI 모델을 학습시켜줬는데 이제는 필요 없어진 거지. 우리는 사실상 부수적인 피해자일 뿐이야. 최상급 AI는 부자들을 위한 것이고, 우리 같은 사람들은 계산기나 두드리며 살게 되겠지.
2
20x 요금제에서 25x 요금제로 업그레이드한 거네. 축하한다.
2
맞는 말이긴 한데, 데이터가 가리키는 핵심을 놓치고 있는 것 같아. 20x에서 25x로 바꿨더니 즉시 사용량이 21.2% 줄어들었어. 즉, 나는 20x 요금제에서 15.8x 요금제로 바뀐 셈인데 돈은 2.5배 더 내고 있는 거지. 결과적으로 사용량 대비 비용이 68.5%나 인플레이션된 거야.
20x 요금제는 다음 달에 10x로 줄어들 텐데, 그건 계산에 넣었음? 그러니까 사실상 이번 달에만 20x에서 25x로 업그레이드되는 셈이잖아.
1
문제는 API랑 구독제 간에 토큰 유형별 상대 가격이 다르다는 거야. 예를 들어 구독제는 캐시된 입력에 더 큰 할인을 해주거든. 네 이전 프롬프트가 캐시된 입력 비중이 가장 높았던 것 같으니, 그게 효율 저하의 일부 원인일 수 있어. 자세한 건 최근 SemiAnalysis 기사를 참고해봐.
1
이거 일시적인 거 아님? 200달러 요금제도 10월 말이면 10x로 바뀌는 거 아냐?
지금 200달러 요금제가 한 달 뒤보다 API 환산 사용량이 더 많은 상태야.
사람들이 말하려는 건(너는 이해 못 하는 것 같지만), OpenAI가 사실상 구독제 가격을 올리고 있고 200달러 요금제는 한 달 동안만 기존 혜택이 유지된다는 거야.