위험한 셸 명령 실행을 사전에 차단하는 (Jev) Pi 가드
A (Jev) Pi guard that checks risky shell commands before they run
핵심 요약
AI 에이전트가 터미널에서 파괴적인 명령을 실행하지 못하도록 사전에 검사하고 차단하는 보안 도구인 'specpi-jev-guard'를 소개합니다.
- 보안 가드 — AI 에이전트의 파괴적인 셸 명령 실행을 방지하는 도구임.
- 작동 방식 — 로컬 규칙으로 즉시 차단하고, 나머지는 Jev 모델이 위험도를 평가함.
- 안전 설계 — 네트워크 연결이 없거나 위험도가 높으면 명령을 차단하는 Fail-safe 구조임.
- 기술 요구사항 — 현재 OpenRouter 또는 TypeSafe를 통한 위험도 평가가 필요함.
tannermidd.github.io
원문 사이트로 이동
또 Jev 이야기라 미안하다... 지겨운 거 알지만 며칠 전 댓글로 언급했던 거라 짧게만 말할게 하하.
이름은 specpi-jev-guard야. bash, powershell, write, edit 앞에 딱 붙어서 Pi가 명령을 실행하기 전에 미리 검사하는 놈이지. 에이전트한테 터미널 권한 줬을 때 제일 위험한 게 파괴적인 명령어잖아. rm 잘못 날리거나 curl로 쉘에 바로 꽂아버리면 진짜 골치 아파지니까 이걸 만든 거야.
로컬 규칙으로 뻔한 것들은 네트워크 안 타고 즉시 차단해. 루트나 홈 디렉토리 날리는 거, mkfs, 포크 폭탄, raw 디스크 쓰기, curl 파이프 쉘 같은 것들 말이야.
나머지는 Jev한테 보내서 위험도를 0에서 1 사이로 점수 매기게 해. 높으면 차단, 중간이면 물어보고, 낮으면 실행해. API 키가 없거나, 네트워크가 안 되거나, 이상한 답변이 오면 그냥 차단해버려. 절대 허술하게 뚫리는 일은 없어.
점수 매기려면 OpenRouter나 TypeSafe가 필요한데, 언젠가 이런 거 로컬에서 돌릴 수 있는 초고성능 분류기도 나오겠지.
난 TypeSafe 권한이 없어서 전부 OpenRouter로만 테스트했어.
피드백 환영한다!
링크:
Base Repo: https://github.com/TannerMidd/specpi-jev-guard
Evaluations: Devious Tests · specpi-jev-guard
Base harness: https://github.com/TannerMidd/SpecPi


