더 이상은 못 참겠어
I Cannot Take This Anymore
핵심 요약
AI 모델의 성능 저하와 일관성 없는 서비스 운영에 지친 개발자의 불만 토로.
- 모델 성능 저하 — 업데이트 이후 모델이 게을러지고 지시사항을 무시함
- 일관성 결여 — 잦은 정책 변경과 사용량 제한으로 작업 효율이 급감함
- 기업의 기만 — 수요 폭증에 대응하기 위해 사용자 몰래 성능을 하향 조정함
- 대안 모색 — 클로드 등 타 모델로 갈아타거나 로컬 모델 사용을 고려함
진짜 더는 못 참겠어서 이 말 하려고 계정 새로 팠다.
AI 기업들 마케팅 전략에 장난감처럼 휘둘리는 거 이제 지긋지긋하다.
Anthropic이 Opus 4.6 이후로 모델들 건드리기 시작하면서부터 모델들이 점점 게을러지고 지시사항도 제대로 안 따르기 시작했거든. 개발자로 일하는 입장에서 이건 진짜 도저히 용납이 안 되는 수준임.
모델이 게으른 것만으로도 빡치는데, 명확하게 지시한 것까지 씹어버리면? 진짜 돌아버릴 것 같음. 거짓말 안 하고.
그래서 딱 하나만 찾기로 했다. 바로 '일관성'이지.
그러다 OpenAI가 코딩 쪽에서 뒤처진 거 깨닫고 다시 증명하려고 애쓰는 걸 봤다. 솔직히 보기 좋더라. 모델들이 문제점을 인지하고 있는 것 같았고, 게으르지도 않았으며, 지시사항도 기가 막히게 잘 따랐거든.
지난 몇 달은 Anthropic 쓰면서 겪었던 그 모든 빡침을 잊게 해줄 만큼 진짜 기적 같았다.
Codex 5.3부터 Astra 출시 15일 전까지, 내 개발 인생에서 AI 쓰면서 가장 생산적이었던 시기였을 거다.
근데 좋은 시절은 역시나 오래 못 가더라.
난 OpenAI가 왜 나 같은 사람들이 Anthropic에서 넘어왔는지 이해하고 있을 줄 알았거든.
난 이렇게 생각했지:
- OpenAI는 새 모델 돋보이게 하려고 기존 모델 성능을 일부러 떨어뜨리진 않을 거다.
- OpenAI는 구독 할당량을 몰래 너프하진 않을 거다.
- OpenAI는 뱅크 리셋(banked resets) 날짜를 멋대로 바꾸거나, '웜업' 기간이라고 하면서 주간 리셋을 제대로 안 해주는 식의 꼼수는 안 부릴 거다.
- OpenAI는 헤비 유저들을 바보 취급하진 않을 거다.
난 OpenAI가 우리가 Anthropic을 떠난 이유가 정확히 이거라는 걸 알고 있다고 믿었다.
근데 지금 상황 봐라:
- Astra는 20x 플랜 써도 반나절이면 다 써버려서 사실상 못 씀.
- Sol 5.6은 이제 확실히 성능 떨어진 게 느껴져서 믿고 쓸 수가 없음.
- Sol 6는 내 작업 방식이랑은 안 맞아서 Sol 5.6보다 더 구린 느낌임.
- Luna는 내 작업 대부분이 복잡한 거라 서브 에이전트 쓸 일이 거의 없어서 사실상 안 씀.
거기다 Astra Max가 갑자기 edit 툴을 제대로 안 쓰기 시작한다고 생각해 봐. 모든 스레드마다 apply_patch 쓰라고 일일이 지시해야 겨우 수정사항 반영되는 꼴이라니.
지금 뱅크 리셋 3개나 쌓여 있는데, 이것조차 거의 쓸모가 없는 기분이다.
왜냐고?
3개 다 합쳐도 이틀도 못 갈 텐데, 그렇게 써봤자 너프 전 Sol 5.6으로 했던 작업량의 절반도 안 나올 테니까.
난 딱 하나만 바란다.
진심으로. 딱 하나.
화려한 신제품 발표? 관심 없다.
모델 이름? 알 게 뭐냐.
마케팅? 좆도 관심 없다.
밑바닥 경험이 계속 바뀌는데 뱅크 리셋 3개 쌓아두는 게 무슨 의미가 있냐.
내가 진짜 원하는 게 뭔지 아냐?
-> 일관성 <-
이게 다다.
근데 지금 AI 판에서 일관성이라는 게 제일 찾기 힘든 기능이 된 것 같다.
이쯤 되니까 뱅크 리셋도 더 이상 감흥이 없다.
내 아주 간단한 요청 하나만 하자.
Astra 출시 15일 전의 그 Sol 5.6으로 돌려줄 수 없냐?
진짜 딱 그것만 원한다.


