“AI 보조금은 끝날 것이고 Codex는 월 999달러가 될 것”이라는 주장은 대부분 헛소리다
“AI subsidies will end and Codex will cost $999/month” is mostly nonsense
핵심 요약
Codex 구독료가 API 사용량 대비 저렴해 보조금을 받는다는 주장은 소매가와 실제 운영 비용의 차이를 간과한 오해라는 분석입니다.
- 비용 산정 오류 — 소매 API 가격과 실제 추론 비용은 다르며 캐싱 기술로 비용이 절감됨
- 운영 효율성 — OpenAI는 자체 인프라를 직접 운영하며 대규모 배치 처리로 비용을 최적화함
- 하드웨어 경제성 — 클라우드 GPU 가격 하락과 기술 발전으로 추론 비용은 점차 낮아지는 추세임
- 구독 모델 수익성 — 헤비 유저와 라이트 유저의 사용량 차이를 고려하면 현재 구독료는 충분히 수익성이 있음
200달러짜리 Codex 구독료를 내는 사람들이 사실은 매달 2,000달러 이상의 API 비용을 쓰고 있고, OpenAI가 그 차액을 일시적인 AI 보조금으로 메꿔주고 있다는 소리가 계속 들리네.
난 그 주장이 영 미덥지 않음.
일단 첫 번째 문제는 소매용 API 가격이 공급자의 실제 추론 비용이랑 같지 않다는 거임. Codex가 수억 개의 토큰을 처리하는 것처럼 보인다고 해서, OpenAI가 그 모든 걸 공개 API 입력 토큰 가격으로 일일이 다시 계산하고 있다는 뜻은 아니거든.
긴 코딩 세션을 돌리면 컨텍스트를 엄청나게 재사용함. 저장소 상태, 대화 기록, 시스템 프롬프트, 이전에 읽은 파일이나 코드 접두사 같은 것들이 계속 반복되니까. 이게 바로 KV/프롬프트 캐싱이 중요한 이유임.
캐싱된 입력값은 공개 API 가격으로 따져도 훨씬 저렴한데, 공급자 입장에서의 한계 비용은 외부 API 고객한테 받는 가격보다 당연히 더 낮겠지.
할당량(quota) 돌아가는 꼴만 봐도 간접적으로 알 수 있음. 새로 연 긴 채팅창은 할당량을 거의 안 잡아먹는데, 예전에 쓰던 엄청 긴 대화창으로 돌아가면 갑자기 확 줄어드는 경우가 있거든. 정확한 계산 방식이 뭔지는 몰라도, 눈에 보이는 토큰 수에 API 정가를 곱하는 것보다 훨씬 복잡한 건 확실함.
그러니까 누가 "내 200달러짜리 Codex 구독으로 2,000달러어치 API를 썼다"고 말하는 건, 보통 그냥 명목상 토큰 수에 소매 API 가격을 곱해봤다는 소리임.
그건 그냥 '소매가로 환산하면 이 정도 된다'는 수치일 뿐이지, OpenAI한테 실제로 얼마가 들어갔는지를 알려주는 지표가 아님.
게다가 OpenAI는 추론 인프라를 직접 운영하잖아. 가동률도 더 높일 수 있고, 반복되는 접두사는 캐싱하고, 요청을 배치로 처리하고, 워크로드를 효율적으로 분산시키겠지. 당연히 자기네 API 마진을 스스로한테 붙일 리도 없고.
하드웨어 경제성도 점점 좋아지고 있음. 클라우드 GPU 용량이 늘어나고 최신 가속기가 추론 처리량을 높여주면서 클라우드 GPU 가격도 떨어지는 추세거든. 당장 AWS만 해도 올해 H200 가격을 꽤 많이 내렸음. 이건 "컴퓨팅 비용이 감당 불가능할 정도로 비싸지니 구독료가 폭등할 수밖에 없다"는 주장과는 정반대되는 상황임.
Codex 가격이 오를 수도 있냐고? 당연히 그럴 수 있지.
200달러짜리 프로 요금제가 사용자 확보를 위한 공격적인 가격 책정일 수도 있냐고? 그것도 맞음.
하지만 "헤비 유저들이 2,000달러어치 컴퓨팅 자원을 몰래 태우고 있고, 벤처 캐피털 돈으로 나머지 1,800달러를 메꾸고 있다"는 결론은 OpenRouter 가격에 토큰 수 곱한다고 나올 수 있는 게 아님.
API 가격은 그냥 소매 상품 가격일 뿐임. GPU 원가를 측정하는 잣대가 아니라고.

