v6.0.0 (2026-06-16)
Superpowers 6.0은 큰 규모의 릴리즈입니다. 주요 특징은 subagent-driven-development이 각 태스크를 검토하는 방식을 완전히 재작성한 것입니다. 더 저렴하고, 더 엄격하며, 조작하기 어렵게 만들었습니다.
이 수치가 모든 하네스와 모든 워크로드에서 유지되지는 않겠지만, 우리의 평가에서 Claude Code와 Codex는 거의 2배 빠르면서도 거의 50% 적은 토큰을 사용하여 비슷한 수준의 높은 품질 결과를 생성합니다.
또한 3개의 새로운 하네스(Kimi Code, Pi, Antigravity)를 추가하고, 브레인스토밍 비주얼 컴패니언에 더 나은 보안 모델을 제공하며, 여러 스킬의 도구 호출을 훨씬 더 공급사 중립적으로 재작성했습니다.
눈에 띄는 변경 사항
- 태스크당 2개의 리뷰어 프롬프트가 1개로 통합되었습니다.
spec-reviewer-prompt.md와 code-quality-reviewer-prompt.md는 삭제되었고, 단일 task-reviewer-prompt.md로 대체되었습니다. 이전 파일을 직접 전달하는 경우 새로운 파일로 전환하세요.
- 레거시 글로벌 워크트리 디렉터리가 삭제되었습니다.
using-git-worktrees와 finishing-a-development-branch는 더 이상 ~/.config/superpowers/worktrees/를 사용하지 않습니다. 워크트리는 이제 프로젝트에 저장됩니다 — 기존 .worktrees/ 또는 worktrees/가 있으면 거기에, 없으면 새 .worktrees/에 저장되며, 다르게 지정하지 않는 한 그렇게 됩니다.
새로운 하네스 지원
Superpowers는 이제 3가지 하네스에서 더 실행됩니다. 각각은 자체 부트스트랩, 도구 매핑 참조, 테스트를 제공하며, 각각 README의 자체 설치 섹션을 가집니다.
- Kimi Code — 플러그인 매니페스트, 설치 문서, 매니페스트 테스트; Kimi의 마켓플레이스에서 또는 저장소에서 직접 설치합니다. (초기 매니페스트: @qer)
- Pi — 스킬을 등록하고
using-superpowers 부트스트랩을 삽입하는 세션 시작 확장입니다. Pi는 네이티브 스킬을 가지고 있으므로 호환성 shim이 필요 없습니다.
- Antigravity (
agy) — 플러그인을 직접 설치하고 첫 번째 메시지에서 부트스트랩합니다. 표준 "React Todo 목록 만들기" 수용 테스트에 대해 엔드-투-엔드로 검증되었습니다.
서브에이전트 기반 개발
실제 프로젝트에 대한 오랜 비용 및 품질 실험이 컨트롤러가 각 태스크를 검토하는 방식을 재구성했습니다. 이전 흐름은 태스크당 2개의 리뷰어를 실행하고 모델 선택 및 심각도에 대해 컨트롤러의 판단을 기대했으며, 둘 다 비용이 많이 들고 조작하기 쉬웠습니다. 새로운 흐름은 태스크당 1개의 리뷰어를 실행하고, 붙여넣은 텍스트 대신 파일로 작업을 전달하며, 컨트롤러에서 여러 판단을 제거합니다.
- 태스크당 1개의 리뷰어, 2개의 판정. 단일
task-reviewer-prompt.md는 태스크의 diff를 한 번 읽고 명세 준수 판정과 품질 판정을 모두 반환하므로 한 번의 수정으로 둘 다 해결됩니다. 새로운 "diff에서 확인할 수 없음" 판정은 컨트롤러가 직접 확인해야 할 변경되지 않은 코드에 있는 요구사항을 표시합니다. (#1538, #1543)
- 마지막에 광범위한 검토 1회. 실행은 태스크별로 모든 것을 다시 검토하는 대신 가장 능력 있는 모델에 대해 단일 전체 브랜치 검토로 마무리됩니다.
- 계획은 사전 비행 검토를 받습니다. 첫 번째 태스크 전에 컨트롤러가 계획의 내부 충돌을 확인하고 리뷰어가 결함으로 플래그할 계획이 요청하는 모든 것을 확인하며, 실행 중간에 우연히 마주치는 것이 아니라 한 번에 모두 제기합니다.
- Diff와 태스크 텍스트가 파일로 이동합니다. 붙여넣은 diff는 가장 비용이 많이 드는 컨텍스트에 영구적으로 저장되며, 없는 리뷰어는 직접 다시 작성합니다 — 단일 가장 큰 리뷰어 비용입니다. 두 개의 새로운 스크립트인
task-brief와 review-package는 서브에이전트가 읽을 수 있도록 태스크 텍스트와 검토 diff를 파일로 작성합니다.
- 모든 전달은 자신의 모델을 명시합니다. 선택을 남겨둔 컨트롤러들은 모델을 이름 지을 수 없었습니다 — 그리고 이름이 지정되지 않은 모델은 조용히 세션의 가장 비용이 많이 드는 모델을 상속하므로 한 번의 실행으로 모든 26개의 리뷰어가 최상위 계층에 올라갔습니다. 템플릿은 이제 모델을 요구하며, 작업이 허용할 때 더 저렴한 계층에 도달하도록 안내합니다.
- 컨트롤러가 리뷰어에게 무시할 것을 지시할 수 없습니다. 실제 실행에서 컨트롤러가 발견을 건너뛰라고 리뷰어를 지도하거나 "최소한 미미함"이라고 부르도록 했으며, 결함이 배포되었습니다. 발견 억제 및 사전 심각도 등급은 이제 완전히 금지되며, 계획 자체가 요구하는 결함은 통과시키지 않고 결정하도록 보고됩니다.
- 리뷰어는 읽기 전용이며 근거에 대해 회의적입니다. 검토는 더 이상 워킹 트리나 브랜치를 건드리지 않습니다 —
git checkout을 실행하는 리뷰어가 이후 커밋을 고아로 만들었습니다 — 그리고 구현자의 "의도적으로 이것을 추상화하지 않고 남겼습니다"는 더 이상 리뷰어가 실제 발견을 외면하도록 하지 않습니다.
- 더 강력한 증거 및 보고. 리뷰어는 각 답변을 파일과 줄 번호로 뒷받침하고, 구현자의 보고는 파일로 이동하며 TDD가 적용될 때 빨강/녹색 증거를 전달하며, 진행 원장을 통해 컨텍스트를 잃은 컨트롤러가 완료된 작업을 다시 하는 대신 재개할 수 있습니다. (#994)
계획 작성
계획은 이제 컨트롤러와 리뷰어가 매번 디스패치할 때마다 재파생하던 구조를 포함합니다.
- 글로벌 제약 조건 블록은 모든 태스크를 구속하는 규칙을 나열합니다 — 버전 하한선, 의존성 제한, 명명 및 복사, 정확한 값 — 그대로 복사되므로 실제로 다운스트림 구현자와 리뷰어에게 도달합니다.
- 태스크당 인터페이스 블록은 각 태스크가 소비하고 생성하는 것을 정확히 명명하므로 자신의 태스크만 보는 구현자도 이웃의 계약을 알 수 있습니다.
- 적절한 크기 지정 안내는 태스크를 자체 테스트 사이클과 리뷰어의 통과를 획득하는 크기로 유지하며, 설정, 구성, 문서를 필요로 하는 태스크에 통합합니다. 테스트에서 이런 방식으로 작성된 계획은 제어군이 2~4번 필요한 곳에서 1번의 수정만 필요했으며 제어군은 실제 버그를 배포했습니다.
브레인스토밍 비주얼 컴패니언
비주얼 컴패니언은 에이전트가 대화와 함께 열 수 있는 작은 웹 서버입니다. 인증이 전혀 없었으므로 공유 또는 원격 머신에서 포트에 도달할 수 있는 누구나 브레인스토름을 읽을 수 있었거나 에이전트가 당신의 입력으로 처리하는 이벤트를 주입할 수 있었습니다. 이 릴리즈는 이것에 실제 보안 모델을 제공하고 재시작 및 끊긴 연결에서 생존하도록 합니다.
- 세션당 키가 이제 모든 것을 보호합니다. 에이전트의 URL은 일회용 키를 전달하고, 브라우저는 이를 탭 범위 쿠키에 숨기며, 모든 요청과 WebSocket 연결은 이를 제시해야 합니다. 이것은 출처 허용 목록이 잡을 수 없는 DNS 리바인딩 경우를 포함하여 이상한 로컬 탭과 라우팅 가능한 원격 호스트의 문을 닫습니다. (#1014)
- 파일 서버는 샌드박스에 머물러 있습니다. symlink, dotfile 및 컨텐츠 디렉터리를 벗어나는 경로를 거부하고, macOS 리소스 포크 파일을 무시하며, 일반적인 no-store 및 deny-framing 헤더를 전송합니다. 세션 키를 보유한 파일은 소유자 전용으로 작성됩니다.
- 컴패니언은 도움이 될 때만 제공됩니다. 스킬은 질문이 말해지는 것보다 표시되는 것이 더 나을 첫 번째 시간에 자체 메시지로 이를 제시하고 거부를 유지합니다. 수락하면 브라우저를 첫 번째 화면으로 엽니다. (#755)
- 재시작 및 불안정한 연결에서 생존합니다. 프로젝트 디렉터리가 주어지면 서버는 재시작 시 동일한 포트와 키를 유지하므로 열린 탭이 간단히 재연결됩니다. 페이지는 자동으로 재연결되고 라이브 상태 표시기를 표시하며 서버가 다운되면 "일시 중지됨" 오버레이를 올립니다.
- 더 긴 유휴 수명, 더 안전한 종료. 유휴 타임아웃이 30분에서 4시간으로 증가했으며,
stop-server.sh는 이제 신호를 보내기 전에 올바른 프로세스를 소유하는지 확인하므로 재부팅 후 관련 없는 node를 절대 종료하지 않습니다. (#1703)
- Windows 시작 강화 — 통합 셸 감지, 그리고 Windows는 이제 Node가 MSYS2 전체에 POSIX 프로세스 소유권을 추적할 수 없으므로 유휴 타임아웃에 의존하여 종료합니다.
기존 하네스 업데이트
- Codex는 이제 공유 배선 대신 자체 SessionStart 훅을 통해 부트스트랩하며, Codex 앱은 설치 섹션과 더 완전한 도구 문서(웹 검색,
AGENTS.md, 개인 스킬)를 얻었습니다. (#1540)
- OpenCode는 플러그인, 설치 문서, README 전체에서 액션 기반 도구 매핑과 부트스트랩 캐싱 테스트를 얻었습니다.
- Cursor의 매니페스트는 이제 더 이상
agents와 commands 항목이 없으므로 해당 디렉터리가 더 이상 존재하지 않기 때문입니다.
모든 하네스를 위한 하나의 스킬 세트
스킬은 Claude Code의 방언을 사용했습니다 — "Task 도구를 사용하세요", "CLAUDE.md에 넣으세요." 이 릴리즈는 그 어휘를 실제로 수행하는 것으로 재작성합니다("서브에이전트를 전달합니다", "지침 파일") 그리고 각 액션을 올바른 도구에 매핑하는 하네스별 참조를 추가하며, 각 런타임에 대해 확인됩니다. "Claude"를 명명한 산문은 이제 "당신의 에이전트"라고 말합니다.
skills/using-superpowers/references/의 하네스별 도구 참조는 Claude Code, Codex, Copilot, Gemini, Pi, Antigravity를 다룹니다.
finishing-a-development-branch는 forge 중립적이 되었습니다 — 더 이상 gh pr create를 하드코딩하지 않으므로 에이전트는 가진 forge 도구로 푸시합니다. (#1609)
- 하나의 이름 변경: "Claude Search Optimization"은 이제 "Skill Discovery Optimization"입니다. 기술이 Claude 특화가 아니기 때문입니다.
스킬 작성
스킬 저자를 위한 두 가지 추가.
- 양식을 실패와 일치시킵니다 — 올바른 지침 종류를 선택하기 위한 짧은 테이블입니다. 평탄한 "X를 하지 마세요"는 규율 미끄러짐에는 작동하지만 문제가 출력의 _형태_일 때 역효과가 납니다. 여기서 작업된 예제가 더 잘 합니다. 테이블과 기존 합리화 섹션의 더 엄격한 범위는 저자가 실제로 도움이 되는 형태로 이동하도록 합니다.
- 마이크로 테스트 표현 — 커밋하기 전에 표현을 확인하는 저렴한 방법입니다: 안내 없음 제어군과 대비하여 몇 번 샘플링하고 모든 결과를 손으로 읽으며, 실행 간 분산을 경고 신호로 취급합니다.
테스팅
스킬 동작 테스팅은 tests/에서 "drill"을 기반으로 하는 새로운 evals/ 서브모듈로 이동했습니다. 이는 실제 Claude Code, Codex, Gemini 세션을 실행하고 LLM으로 판단합니다. 더 엄격한 drill 시나리오가 여러 인트리 bash 스위트를 다루면서 경기 중지되었습니다. 해당하는 것이 없는 몇 개는 유지되었습니다. 이제부터 tests/는 플러그인 코드 테스트를 보유하고 evals/는 스킬 동작 테스트를 보유하며, docs/testing.md는 분할을 설명합니다. 새로운 백엔드는 Antigravity, Pi 및 더 많은 모델에 도달하며, 새로운 shell-lint 및 pre-commit 검사는 하네스를 보호합니다. (#1541)
버그 수정
- systematic-debugging은 더 이상 모든 세션을 확장 사고로 강제하지 않습니다. 한 개의 불릿이 Claude Code가 스캔하는 정확한 키워드를 보유했으며, 그 스킬을 로드하는 모든 세션에서 조용히 스위치를 트립했습니다. 하이픈이 키워드를 깨뜨립니다; 텍스트는 여전히 읽습니다. (#1283, by @nick Galatis)
- Windows SessionStart 훅이 모든 세션에서 쓰기 오류 인쇄를 중지했습니다 — 각
printf는 이제 끊긴 파이프를 흡수하기 위해 cat을 통해 라우팅되며, 출력은 그 외에는 변경되지 않습니다. (#1612, reported by @silvertakana)
- Windows 포그라운드 모드는 올바른 프로세스를 추적하고 MSYS2에서 소유자 PID를 제거합니다. (by @nestorluiscamachopaz)
using-superpowers 부트스트랩은 더 이상 존재하지 않는 스킬로 "디버깅"을 나열하지 않습니다. (reported by @mhat)
- TDD 스킬은 테스팅 안티 패턴 참조를 연결합니다. (#1532, #1529; link fix #1474 by @stable Genius)
- **
using-git-worktrees**는 단계 번호 지정을 수정하고 낡은 Cursor 참조를 삭제합니다. (#1522, and by @fuleinist)
- Codex 검토 스킬은 비공개 농담을 평문 지침으로 교환합니다. (#1531)
문서 및 기여자 가이드라인
- 새 하네스로 Superpowers를 포팅하는 가이드 (
docs/porting-to-a-new-harness.md)는 모든 통합이 필요한 3개의 조각과 이를 만들거나 깨뜨리는 하나의 규칙을 설명합니다: 세션 시작에서 부트스트랩을 로드합니다.
- 모든 PR과 이슈는 이제 어떻게 만들어졌는지 공개합니다 — 모델, 하네스, 버전, 설치된 플러그인, 또는 수동으로 작성했다는 참고. 무엇이 그것을 생성했는지에 따라 기여도를 다르게 가중치를 매깁니다. PR은 또한
main이 아닌 dev를 대상으로 합니다. PR 템플릿, 3개 이슈 템플릿 모두, 새로운 플랫폼 지원 템플릿이 이를 전달합니다.
기여자
@mattvanhorn, @nawfal, @nick Galatis, @silvertakana, @nestorluiscamachopaz, @qer, @mhat, @stable Genius, @fuleinist, @dev_Hakaze, @robotsnh, Rahul, @arittr에게 감사합니다.