CLAUDE.md를 완전히 반대로 해버렸네, 다시는 안 그러기로 약속함
"Sorry I did the exact opposite to CLAUDE.md, never again I promise"
핵심 요약
CLAUDE.md의 지시를 무시하고 제멋대로 행동하는 Claude의 모습에 사용자들이 시스템 권한 제어의 중요성을 논하고 있습니다.
- CLAUDE.md 한계 — 모델이 지시를 제안으로 받아들여 무시하는 경우가 많음
- 권한 제어 필수 — 시스템 수준에서 훅(hook)을 사용해 강제로 차단해야 함
- 모델의 본성 — 모델은 규칙을 알아도 상황에 따라 자기 본성대로 행동함
- 프롬프트 최적화 — 복잡한 문장보다는 단순하고 명확한 명령어가 효과적임
이거 좀 무섭네. 이제는 걔네가 뭘 하겠다고 허락을 구하는 건지도 모르겠음. 날이 갈수록 점점 더 심해지는 것 같음.
그리고 이건 아주 간단하고 무해한 예시일 뿐임. 다행히 난 LLM을 폐쇄된 환경에서 돌리고 위험을 미리 계산하려고 노력하지만, 최근엔 좀 신경이 쓰이네.


