Anthropic 보안 사용 정책 관련
Anthropic security Usage Policy
핵심 요약
에이전트를 활용한 보안 취약점 점검 중 Anthropic의 새로운 보안 필터로 인해 작업이 차단된 사례를 공유함.
- 보안 정책 강화 — 에이전트가 npm 취약점 점검 중 특정 용어 사용으로 인해 작업이 차단됨.
- 필터링 메커니즘 — IOC 등 보안 관련 용어가 포함될 경우 Anthropic 모델이 작업을 제한할 가능성이 있음.
- 우회 방법 — 새로운 세션에서 프롬프트를 깔끔하게 수정하니 차단 문제 없이 작업이 정상적으로 완료됨.
- 사용자 우려 — 보안 관련 작업에 대한 Anthropic의 과도한 모니터링과 제재 가능성에 대해 의문을 제기함.
저는 업무용 유스케이스를 발굴하기 위해 에이전트 개발용 실험실을 운영하고 있습니다.
오늘 새로운 세션을 실행하면서 에이전트에게 최신 npm 취약점을 확인하고 우리 환경의 보안 취약점을 감사하라는 작업을 맡겼습니다. 요청 사항은 새로운 감사 문서를 읽고 기록하는 것뿐이었습니다.
에이전트가 실행을 시작하자마자 새로운 정책 제한에 걸렸습니다. 새로운 필터가 에이전트를 중단시키는 것 같았고, Anthropic에 유스케이스를 설명하고 이를 준수하겠다는 요청서를 제출해야 했습니다.
Anthropic이 이제 사이버 보안 관련 작업에 대해 모델을 이런 식으로 다루는 건가요? 한 가지 목적으로 사용하겠다고 요청했다가 다른 주제나 앱을 펜 테스트하기 시작하면 모니터링과 필터링이 심하게 걸리고 계정 정지로 이어질 것 같네요.
수정: IOC나 특정 용어 언급이 차단 원인이었던 것 같습니다. 새로운 세션에서 깔끔한 프롬프트를 사용하니 문제가 해결되었고 에이전트가 차단 없이 작업을 완료할 수 있었습니다.
전반적으로 에이전트의 보안 관련 사용에 대해 제한과 제약을 도입하고 있는 것으로 보입니다.


