와, 프론티어 모델들 성능이 다 비슷한 줄 알았는데, 완전히 틀렸었네!
Wow, I thought frontier models were on par, but I was completely wrong!
핵심 요약
Claude Code와 Codex를 비교하며 Claude의 압도적인 이해력과 작업 효율에 감탄하는 글.
- Claude Code 성능 — Codex 대비 압도적인 이해력과 작업 효율을 보여줌.
- 워크플로우 비교 — Next.js, Rust 등 복잡한 환경에서 Claude가 훨씬 유연함.
- 모델별 역할 — Claude는 기획과 구현, Codex는 검토 및 최적화에 활용됨.
- 구독 전략 — 두 모델의 장점을 살리기 위해 병행 사용하거나 상황에 맞춰 선택함.
안녕, 난 요즘 90% 이상 '바이브 코딩(vibe coding)'으로 진짜 복잡한 앱들 만드는 중이야.
12년 넘게 굴러먹은 시니어 개발자인데, 내 경험 좀 공유해 볼게.
2025년에 Opus/Sonnet 3.5 시절에 Cursor를 써봤거든. 근데 웹 아닌 거 건드리기엔 너무 빡세서 좀 깔짝대다가 구독 취소하고 그냥 살았지.
올해 들어서 Pro 5x 구독으로 GPT 5.5 기반 Codex를 써봤는데, 드디어 복잡한 것도 어느 정도 믿고 맡길 만하더라고. 꽤 괜찮았고, 덕분에 일도 쳐내면서 .md 파일 기반의 에이전트 워크플로우를 어떻게 굴려야 할지 감도 잡았어.
근데 지난주에 Claude Code랑 Holly Picles 써보고 나서 진짜 신세계를 맛봤다. Claude는 내가 뭘 원하는지 완벽하게 이해하는 느낌이야. 내가 일일이 방향 잡아주거나 수정할 일이 거의 없었어.
내 작업 기준으로 Opus 5 대비 Fable이 퀄리티가 더 좋다는 느낌은 못 받았고, Fable은 토큰만 너무 빨리 녹더라. 그래서 난 그냥 Sonnet이랑 Opus만 써. Fable은 빡센 기획이나 뇌 비우고 질문 던질 때만 씀. Claude Max 5x가 GPT Pro 5x보다 유지력도 더 좋은 것 같고.
결국 GPT Pro 5x 구독은 끊고 Claude Max 5x만 남겼어. GPT 구독 기간이 며칠 남아서 Claude 주간 사용량 다 쓴 김에 남은 기간 동안 Codex로 작업 좀 마무리하려고 다시 켰거든.
근데 진짜 못 써먹겠더라. GPT Sol은 뭐만 하면 코드를 다 갈아엎으려고 들어. 수정 범위도 쓸데없이 크고, 코드도 과하게 복잡하게 짜놔. 그냥 Claude 사용량 초기화될 때까지 기다리는 게 낫겠어.
이게 내 작업 환경에서만 유독 그런 거야, 아니면 너네도 Claude랑 Codex 쓰면서 비슷한 경험 해본 적 있어?
내 워크플로우는 기본적으로 Next.js에 Rust CLI 몇 개, 그리고 Rust로 짠 커스텀 네이티브 모듈 들어간 React Native야. 로컬 3D 프린터 통신이랑 브릿징, 그리고 프린터 웹 노출 같은 거 하는데, 주로 Bambulab, Elegoo, Flashforge 기기들 다뤄.
지금 여러 브랜드랑 모델 지원해서 명령어를 하나의 드라이버로 통합하는 3D 프린터 통합 관리 앱이랑 웹 인터페이스 만들고 있어.
아, 그리고 이거 SaaS나 제품 같은 거 아님. 그냥 내 3D 프린터 팜에서 내가 원하는 대로 돌아가게 만들고 있는 거야. 내가 테스트해 본 솔루션들 중에 내가 원하는 방식을 완벽하게 지원하는 게 하나도 없더라고.


