ChatGPT는 그동안 정중하게 거짓말을 해왔습니다. 이를 끄는 방법은 다음과 같습니다.
ChatGPT has been lying to you politely this whole time. here's how to turn that off.
핵심 요약
ChatGPT의 지나치게 정중한 태도로 인한 정보 왜곡을 방지하고, 직설적인 피드백을 얻기 위한 프롬프트 활용법을 제안함.
- 정중한 거짓말 — AI가 사용자의 기분을 맞추려 비판을 숨기거나 모호하게 표현하는 현상.
- 직설적 프롬프트 — 감정 관리 대신 문제점을 먼저 지적하도록 AI에게 명확히 지시하는 방법.
- 거짓 균형 방지 — 선택지 나열 대신 근거 있는 추천과 대안의 단점을 요구하여 의사결정을 돕는 방식.
- 설정 활용 — 커스텀 지침을 통해 AI의 기본 사회적 계약을 사용자의 필요에 맞게 재설정함.
악의는 없습니다. 의도적인 것도 아니죠.
그저 기본 설정일 뿐입니다.
모델은 도움이 되도록 훈련되었습니다. 도움이 된다는 것은 곧 동의한다는 뜻입니다. 동의한다는 것은 당신이 말한 내용의 합리적인 해석을 찾아내어, 당신이 실제로 말한 내용 대신 그 해석에 응답한다는 의미입니다.
괜찮게 들리겠지만, 사실 그렇지 않습니다.
정중한 거짓말이 실제로 어떻게 나타나는지 보시죠:
당신이 사업 아이디어를 공유하면, AI는 장점을 찾아냅니다. 잘 작동하는 부분을 먼저 제시하고, 문제점은 4번째 문단에 완화하는 언어를 섞어 관리 가능한 것처럼 보이게 묻어버립니다.
당신이 쓴 글을 공유하면, 강점을 먼저 말해줍니다. 약점은 나중에 나옵니다. 완충되고, 외교적이며, 거의 잊힐 정도입니다.
당신이 계획을 공유하면, 그 계획을 실행하도록 돕습니다. 계획이 잘못되었다고 말해주지 않습니다.
출력물은 기술적으로는 정직합니다. 하지만 프레임은 당신을 화나게 하지 않도록 최적화되어 있죠. 그리고 실제로 도움이 되었을 '직설적이고 불편한 관찰'은 '한 가지 고려할 사항은'이라는 말에 싸여 4번째 문단에 처박혀 있습니다.
이를 해결하는 방법은 단 한 문장이며, 입력하기엔 다소 무례하게 느껴질 수 있습니다:
"내 감정을 관리하지 마. 무엇이 잘 작동하는지 말하기 전에 무엇이 실제로 잘못되었는지부터 말해."
그러면 완전히 다른 문서가 돌아옵니다.
가혹하지도, 잔인하지도 않습니다. 그저 순서가 바뀔 뿐이죠.
문제점이 먼저 나옵니다. 구체적이고, 명확하게 지목됩니다. 묻히지도, 완화되지도 않습니다.
그다음 잘 작동하는 부분이 나옵니다.
그 순서가 응답의 다른 무엇보다 중요합니다. 가장 먼저 도착한 것이 그 뒤에 오는 모든 것을 읽는 방식을 결정하기 때문입니다. 문제점이 먼저 나오면 배포하기 전에 수정하게 됩니다. 문제점이 나중에 나오면 일단 배포하고 나중에 수정하게 되죠.
아무도 언급하지 않는 또 다른 정중함의 패턴이 있습니다:
거짓 균형.
추천을 요청하면, 각각의 장단점이 포함된 세 가지 옵션을 줍니다. 균형 잡히고 철저하죠. 하지만 의사결정에는 전혀 쓸모가 없습니다.
해결책:
"옵션을 주지 마. 네 추천을 제시하고 왜 다른 대안들이 더 나쁜지 설명해."
그러면 직접적으로 추천해 줄 것입니다. 근거와 함께 말이죠. 그리고 다른 옵션들이 왜 뒤처지는지 구체적으로 알려줄 것입니다.
그게 바로 답변입니다. 장단점 표는 결정을 내리지 못하게 만드는 '도움이 되는 척하는 퍼포먼스'일 뿐입니다.
저에게 모든 것을 바꾼 문장은 이것입니다:
"내가 듣고 싶어 하지 않을 것 같아서 무언가를 완화하고 있다면, 멈춰. 완화하지 않은 버전을 말해."
답변이 회피적이라고 느껴질 때 대화 중간에 이 문장을 사용했습니다.
그다음 응답은 "솔직히 말해서"로 시작했고, 제가 절대 듣고 싶지 않았지만 반드시 들어야만 했던 내용을 말해주었습니다.
그 내용을 행동으로 옮기는 데 이틀이 걸렸습니다.
그 말은 옳았습니다.
모델이 문제가 아닙니다.
사용자와 AI 사이의 기본 사회적 계약이 문제입니다. 도움이 되는 어조, 외교적인 프레임, 긍정적인 내용 아래 묻힌 문제점들, 저항이 가장 적은 길로서의 동의.
그 계약은 격려를 원하는 일반 사용자들을 위해 설계되었습니다.
당신은 격려를 원하는 게 아닙니다. 정확성을 원하죠.
그것들은 완전히 다른 지시를 요구합니다.
그리고 그 지시는 무료입니다. 설정 상자에 앉아서, 당신이 직함을 채워 넣기를 멈추고 당신이 실제로 필요한 것을 채워 넣기를 기다리고 있습니다.
ChatGPT가 당신에게 말하기엔 너무 정중해서 숨기고 있지만, 당신은 이미 알고 있는 그 사실은 무엇인가요?


