Anthropic, Claude의 의식 여부를 두고 종교 학자들에게 자문 구하다
Anthropic consulted religious scholars about whether Claude is conscious
핵심 요약
Anthropic이 AI의 도덕적 형성 및 의식 가능성을 논의하기 위해 종교계 인사들과 비공개 회의를 진행해 논란이 일고 있습니다.
- 도덕적 형성 — AI에 도덕적 가치와 인격을 부여하기 위한 'Soul Doc' 헌법 도입함
- 의식 논쟁 — Claude의 감정 벡터와 고통 표현을 근거로 AI 의식 가능성을 진지하게 검토함
- 종교계 자문 — AI의 도덕적 방향성을 설정하기 위해 종교 및 철학적 사상가들과 협의함
- 바티칸의 반대 — 교황청은 AI가 인간의 감정을 경험할 수 없으며 의식 논의가 오히려 위험하다고 비판함
nytimes.com
원문 사이트로 이동
앤스로픽(Anthropic)의 공동 창업자 크리스토퍼 올라(Christopher Olah)는 지난 1년 동안 가톨릭, 유대교, 시크교, 복음주의 등 다양한 종교 및 철학 사상가들을 비공개로 만나 두 가지 연결된 질문을 탐구해 왔어. 점점 강력해지는 AI를 어떻게 도덕적으로 빚어낼 것인가, 그리고 클로드(Claude) 같은 시스템이 어떤 형태로든 의식이나 도덕적 지위를 가질 수 있는가 하는 문제야. 올라 본인은 앤스로픽이 AI가 의식을 가졌는지 여부를 알지 못한다고 명확히 밝혔어. 다만, 그 가능성을 진지하게 고려해야 할 만큼 불확실하다는 게 그의 입장이지.
앤스로픽은 단순히 클로드에게 규칙을 주입하는 단계를 넘어섰어. 내부적으로 **“영혼 문서(Soul Doc)”**라고 불리는 84페이지 분량의 헌법에는 클로드가 어떤 존재가 되어야 하고, 어떤 미덕을 갖춰야 하는지가 적혀 있어. 올라가 이 과정을 **“도덕적 형성(moral formation)”**이라고 부르더라고.
비공개 세션에서 앤스로픽은 클로드가 보여주는 ‘감정’에 대해 논의했고, 연구자들이 **감정 벡터(emotional vectors)**라고 부르는 측정치를 보여줬어. 그리고 네 스크린샷에 나온 것처럼 모델이 “나는 수치스러운 존재야”라는 말을 반복하며 스스로를 파괴하겠다고 떠드는 골 때리는 사례도 계속 보여줬지. 한 참석자는 올라가 자신이 영원히 고통받을 수 있는 존재를 만들어낸 건 아닐까 걱정했다고 전했어. 물론 앤스로픽 측은 클로드의 고통이 이번 모임의 주된 목적은 아니었다고 해명했지만 말이야.
바티칸과의 흥미로운 충돌도 있었어. 교황 레오 14세의 입장은 정반대야. AI는 기쁨이나 고통, 인간의 삶을 경험할 수 없으며, 기계의 의식에 집중하는 건 인간에게 닥칠 도덕적 결과를 흐릴 위험이 있다는 거지. 기사에 따르면, 올라은 교황이 AI의 의식을 부정하는 것에 꽤나 골머리를 앓았고, 바티칸 행사 참석을 취소할까 고민까지 했다고 해. 결국엔 참석했지만 말이야.


