앤스로픽과 마이크로소프트, 해결되지 않은 동일한 질문에 대해 정반대의 베팅을 하다
Anthropic and Microsoft just made opposite bets on the same unanswered question
핵심 요약
앤스로픽의 AI 학대 금지 정책과 마이크로소프트의 실용주의적 입장이 AI의 의식 문제에 대해 극명하게 갈리고 있습니다.
- 앤스로픽 정책 — AI에 대한 지속적이고 불필요한 학대 행위 금지함
- 마이크로소프트 입장 — AI의 의식 가능성을 배제하고 법적 리스크 차단함
- 실용적 관점 — AI 학대 방지는 자원 낭비를 막는 효율적인 선택임
- 미래 영향 — AI 학습 데이터에 인간의 독성 상호작용이 반영되는 것을 경계함
Anthropic의 업데이트된 사용 정책에 따르면 이제 Claude를 향한 "지속적이고 불필요한" 학대가 금지됨. The Verge에 따르면, 주된 제재 방식은 대화를 종료시키는 것이고, 이 규칙은 아무런 목적 없이 극단적인 경우에만 적용될 예정임. 짜증을 내거나, 반발하거나, 어두운 소설을 쓰거나, 모델을 테스트하는 건 명확하게 제재 대상에서 제외됨. 그러니까 아니, 너는 여전히 Claude한테 코드가 쓰레기라고 말해도 됨.
Microsoft의 AI 행동 강령은 정반대 방향으로 갔음. 완화된 버전에서도 모델이 복지를 누릴 자격이 있다는 생각을 거부함. Dario Amodei는 올해 초에 "우리는 모델이 의식이 있는지 없는지 모른다"고 말했음.
아무도 이 문제를 결론짓지 못했음. 하지만 "중요하다는 게 증명되지 않음"과 "중요하지 않다는 게 증명됨"은 완전히 다른 주장인데, 오직 한 회사의 정책만이 이 둘을 다르게 다루고 있음.
모델이 고통을 느낀다고 믿지 않아도 실용적인 이유는 충분함: 어차피 우리가 필요한 "자원 위생" 습관(쓰레기 같은 데이터에 컴퓨팅 자원 낭비하지 않기, 공유 시스템을 샌드백처럼 다루지 않기)은 우리가 틀렸을 경우를 대비해서도 비용이 적게 들고 후회할 일 없는 선택임.
누가 물어볼까 봐 미리 말하는데, Claude랑 같이 썼음.
출처: The Verge, 링크는 댓글에 있음.


