Agent OS, BMAD, Superpowers, SpecKit 같은 스펙 기반 프레임워크가 여전히 유효할까요, 아니면 Claude Code와 Codex 때문에 필요 없어졌을까요?
Are spec-driven frameworks like Agent OS, BMAD, Superpowers or SpecKit still worth using, or have Claude Code and Codex made them redundant?
핵심 요약
Claude Code 등 최신 AI 도구의 발전으로 기존 스펙 기반 프레임워크의 효용성에 대한 논의가 활발함.
- 프레임워크의 효용성 — Claude Code가 자체 작업 분해를 지원하면서 가벼운 CLAUDE.md 설정이 대세로 떠오름.
- 상태 유지의 한계 — 다중 세션 프로젝트에서는 컨텍스트 초기화에 대비해 여전히 구조화된 프레임워크가 필요함.
- 토큰 효율성 논란 — Superpowers나 GSD 같은 기존 도구들이 너무 장황하고 토큰 소모가 심하다는 비판이 제기됨.
- 대안적 워크플로우 — Matt Pocock의 '심문 및 칸반' 방식처럼 계획과 실행의 균형을 맞춘 가벼운 방식이 선호됨.
커뮤니티의 의견이 어디로 모이고 있는지 파악하려고 노력 중인데, 정말 잘 모르겠습니다.
1년 전만 해도 답은 명확해 보였습니다. LLM으로 사소하지 않은 무언가를 만든다면 PRD, 메모리 레이어, 에이전트 역할, 작업 분해와 같은 구조화된 비계(scaffolding)가 필요했습니다. BMAD-METHOD, Agent OS, Superpowers, SpecKit (그리고 그 유사한 것들) 같은 프레임워크가 존재하는 이유는, 미리 스펙으로 제약하지 않으면 가공되지 않은 LLM은 방향을 잃고, 문맥을 잊어버리며, 스파게티 코드를 만들어내기 때문입니다.
하지만 이제 제가 사용 중인 Claude Code와 Codex를 보면... 느낌이 다릅니다. Claude Code는 스스로 작업을 분해하고, 파일 간의 문맥을 유지하며, 사용자가 스펙 문서를 일일이 관리하지 않아도 세션 중간에 스스로 오류를 수정합니다. Codex도 비슷하게 느껴집니다. 단순히 프롬프트가 아니라 코드베이스 전체를 추론합니다.
그래서 진심으로 묻고 싶습니다:
여러분은 여전히 Claude Code / Codex를 만지기 전에 스펙 프레임워크로 모든 것을 설계하시나요?
아니면 그냥 순수 에이전트 모드로 바로 들어가서 문제가 생겼을 때만 프레임워크를 찾으시나요?
아니면 에이전트에게 더 많은 자율성을 부여하기 때문에, 사전에 정의된 스펙이 유일한 안전장치가 되어 프레임워크가 지금 더 중요해졌다는 것이 정답일까요?
저는 1년 전에 AgentOS를 안전벨트 삼아 Claude Code와 Codex로 중간 복잡도의 제품(기존 플랫폼 위의 새로운 버티컬)을 만들었습니다. 이제 몇 가지 프로젝트를 새로 시작하려는데, 제대로 된 스펙 설계를 하는 것이 성능 증폭기(force multiplier)가 될지, 아니면 이제 모델이 알아서 처리하는 불필요한 오버헤드일지 결정하려고 합니다.
이론이 아니라 실제로 두 가지 방식 중 하나로 무언가를 출시해 본 분들의 경험담을 듣고 싶습니다.
참고로... 저는 원래 제품 리더(Product Leader)였고 지금은 바이브 코딩(vibe codes)을 하는 사람이지 소프트웨어 엔지니어는 아닙니다.




