Claude Code의 피드백 허니팟이 진화하고 있다
Feedback honeypot in Claude Code has evolved
핵심 요약
Claude Code가 사용자 데이터를 수집하기 위해 피드백을 유도하는 교묘한 방식을 사용한다는 의혹이 제기되었습니다.
- 피드백 허니팟 — 사용자가 거부 의사를 밝혀도 이를 피드백으로 간주해 데이터 수집에 활용함
- 교묘한 프롬프트 — 실수로 누르기 쉬운 키를 유도하여 세션 기록 공유에 동의하게 만듦
- 개인정보 설정 우회 — 글로벌 옵트아웃 설정을 무력화하는 방식으로 데이터 수집을 강행함
- 사용자 불신 — 기업들이 법적 허점을 이용해 사용자 상호작용 데이터를 무단으로 학습에 사용함
Anthropic이 이용 약관에 교묘하게 숨겨놓은 내용에 따르면, 우리가 모델 학습을 전역적으로 거부하더라도 그들에게 '피드백'을 제공하면 우리 데이터나 대화 내용을 학습에 사용한다고 합니다. 이것이 바로 Claude Code에 'Claude가 잘하고 있나요? (선택 사항)'라는 허니팟이 있는 이유입니다. 1, 2, 3, 4, 0 중 하나를 입력하면 응답이 제출되죠. (제가 읽은 불만 사항에 따르면 0을 눌러 창을 닫는 것조차 피드백으로 집계된다고 하는데, 확인할 방법은 없습니다.) 이제는 더 심각한 걸 보기 시작했습니다. 'Anthropic이 세션 기록을 확인해도 될까요?'라는 프롬프트가 뜨는데, 응답은 실수로 누르기 쉬운 키(예: 'y'는 예, 'n'은 아니오, 'd'는 닫기)를 누르도록 유도되어 있습니다. 제가 'n'을 눌렀을 때 Claude Code는 '피드백을 주셔서 감사합니다!'라는 메시지를 띄웠습니다. 이는 '아니오'라고 응답한 것조차 약관상 피드백으로 간주되어 학습용 데이터를 훔쳐 가겠다는 뜻으로밖에 안 보입니다. 게다가 '다시 표시 안 함'을 위해 'd'를 누르는 것이 암묵적으로 전체 동의(마치 '네, 언제든 제 기록을 봐도 좋아요'라는 뜻처럼)로 처리되는지도 불분명합니다. 우리의 전역 개인정보 설정을 무력화하는 이런 허니팟 프롬프트 삽입과 불투명한 운영 방식에 대해 다들 어떻게 생각하시나요?


