Claude는 "솔직히", ChatGPT는 "탐구하다". AI 텍스트는 공식 워터마크가 나오기 훨씬 전부터 이미 워터마크가 찍혀 있었다.
Claude says "honestly", ChatGPT says "delve". AI text was watermarked long before the vendors shipped actual watermarks.
핵심 요약
주요 AI 모델들이 저마다 고유한 말투를 가지고 있어, 이제는 텍스트만 봐도 어떤 모델인지 구별할 수 있는 수준이 되었습니다.
- 모델별 말투 — Claude의 '솔직히'나 ChatGPT의 '탐구하다'처럼 각 모델은 고유한 습관적 표현을 가짐
- 학습의 산물 — 모델의 특정 문체는 의도된 워터마크라기보다 학습 데이터와 훈련 방식에서 기인한 결과물임
- 기술적 워터마크 — 최근 도입된 보이지 않는 워터마크와 달리, 사용자는 이미 모델의 문체를 통해 AI임을 식별해왔음
- 인간의 모방 — AI와 자주 대화하다 보면 인간도 모르게 AI의 말투를 따라 하게 되는 현상이 발생함
난 AI 챗봇 나오기 훨씬 전부터 이 바닥에 있었음. 직접 ML이랑 RL 모델 돌려가면서 실무 문제 해결하던 놈임.
요즘은 일할 때나 놀 때나 이런 모델들 매일 쓰는데, 어느 순간부터 얘네가 뱉는 글을 그냥 'AI가 쓴 글'이 아니라 '클로드체', '챗GPT체'로 읽게 되더라. 다 똑같은 말투가 아님. 모델마다 고유의 버릇이 있어서, 몇 번 읽어보면 문단 하나만 봐도 어떤 모델인지 바로 감이 옴.
클로드는 내가 제일 잘 알지. 맨날 "솔직히 말해서(honestly)"로 시작하고, 설명할 땐 "이게 말이죠(Here's the thing)"로 운을 떼거든. 내가 제일 좋아하는 건 시간을 '저녁' 단위로 측정하는 건데, "이거 하려면 저녁 시간 좀 써야 할걸요" 같은 식임. "완전 맞아요!(You're absolutely right!)" 남발하는 건 하도 심해서 claude-code 깃허브 저장소에 버그 리포트까지 올라왔을 정도임. 이번 여름에 이코노미스트가 모델 출력물 55,940문장을 인간이 쓴 글이랑 비교해 봤는데, 대형 모델 중에 대시(em dash)를 여전히 남발하는 건 클로드밖에 없더라.
챗GPT는 '탐구하다(delve)' 모델인 거 다들 알지? 근데 진짜 시그니처는 따로 있음. 바로 "X가 아니라 Y입니다(It's not X, it's Y.)"라는 구조임. 워싱턴 포스트가 챗GPT 메시지 328,744개를 분석했는데, 이 문장 구조가 계속 튀어나오고, 이모지랑 지들만 좋아하는 단어 몇 개가 좁게 반복되더라.
제미나이는 무슨 브리핑 문서 읽는 느낌임. 뭐만 하면 헤더 달고, "상당한(significant)", "점점 더(increasingly)", "결과(consequences)" 같은 단어만 골라 씀.
그록은 뭐, 출력물 자체가 그냥 인격 그 자체임. 억지로 쿨한 척하는 말투에, 하나도 안 웃긴 비꼬기까지. 비서처럼 안 보이려고 애쓰는 게 다 느껴짐. 어쩌면 제일 티 안 나는 놈일지도.
이게 나한테 왜 웃기냐면, 진짜 워터마크가 이제야 도입됐다는 거임. 앤스로픽은 이제 클로드 텍스트에 보이지 않는 워터마크를 직접 박아 넣고, 구글은 2024년부터 제미나이에 SynthID를 심어놨거든. 기계들은 탐지기가 있어야만 읽을 수 있는 숨겨진 신호를 주고받는데, 우리 인간들은 이미 눈에 보이는 말투로 다 알아채고 있었다는 게 참 아이러니하지.
너네도 느끼고 있냐? 슬슬 질리지 않냐?
과연 모델들이 인간처럼 글 쓰게 되는 날이 오긴 할까? 아니면 애초에 그런 건 허용되지 않는 걸까?


