Claude의 '안전 분류기', 특히 최신 버전에서 제어 불능 상태임
Claude's "Safety Classifier" Thing, especially with new versions, OUT OF CONTROL.
핵심 요약
Claude Code의 과도하게 광범위한 안전 분류기가 합법적인 리버스 엔지니어링 작업까지 차단하며 사용자 경험을 저해하고 있습니다.
- 분류기 오작동 — 합법적인 리버스 엔지니어링 작업까지 무차별적으로 차단함
- 컨텍스트 오염 — 차단 발생 시 되돌리기(rewind)가 불가능해 대화 맥락이 망가짐
- 정책 불만 — 약관에 명시되지 않은 외부 정책을 강요하는 것에 대해 사용자가 반발함
- 대안 모색 — 일부 사용자는 다른 AI 모델 사용이나 별도 그룹 참여를 제안함
로우 레벨 시스템 프로그래밍이나 합법적인 리버스 엔지니어링 같은 거에 관심 많은 사람으로서 말하는데, Claude Code의 새로운 "notice" 시스템이랑 그 분류기(classifier)가 진짜 개판임. 내가 뭘 하든, 내 프로그램 디스어셈블을 하든 다른 걸 리버스 엔지니어링하든 그냥 다 막아버리는데, 이건 뭐 주제를 가리지도 않음.
이건 진짜 못 참겠다. 돈 내고 쓰는 고객 입장에서 말하는데, 도대체 왜 이렇게 시도 때도 없이 "BLOCKED ACTIONS"랑 "CLAUDE CODE NOTICE"가 뜨는지 이유를 1도 모르겠음.
이게 안전 때문이라는 건 개소리임. 뭐가 안전하고 뭐가 아닌지는 나도 눈이 달려 있어서 구분할 줄 안다고. "지나치게 광범위한 분류기"는 해결책이 아니라, 그냥 제대로 된 작업을 하나도 못 하게 방해하는 쓰레기일 뿐임.
심지어 그 시점에서 되돌리기(rewind)조차 안 됨. "지나치게 똑똑한" 분류기가 깃발을 꽂아버리면, 그 똑똑함 때문에 아무것도 못 하게 막히고 전체 컨텍스트가 그냥 오염돼 버림.
이제 모델은 작업을 수행하는 게 아니라, 모델을 바꿔도 분류기가 뭘 원하고 뭘 싫어하는지만 눈치 보느라 바쁨. 근데 분류기는 피드백도 안 주는 블랙홀이라, 이 짓거리가 무한 반복됨.
이거 당장 해결해. 부탁하는 게 아니라 요구하는 거임. 만약 "합법적인 신원 인증" 같은 걸로 기능을 제한하고 싶었으면, 애초에 그걸 먼저 도입했어야지.
나 사이버 보안 프로젝트나 생화학 무기, 악성코드 만드는 거 아님. 그냥 순수하게 예전부터 하던 디스어셈블이랑 리버스 엔지니어링 작업이라고. "지나치게 광범위한" 분류기 범위 좀 제대로 수정해라.
수고.
