Claude만의 특별한 비결은 무엇이며, 왜 아무도 이를 복제하지 못하는가?
What is the secret sauce Claude has and why hasn't anyone replicated it?
핵심 요약
Claude 특유의 말투와 개성이 단순한 프롬프트 엔지니어링을 넘어선 헌법적 AI와 정교한 RLHF의 결과물이라는 분석이 지배적입니다.
- 헌법적 AI — 명시적 규칙 대신 윤리적 가치를 학습시켜 모델의 일관된 성격과 판단력을 형성함
- RLHF의 중요성 — 단순한 출력물 복제가 아닌 모델의 행동을 형성한 보상 모델의 깊은 영향력
- 철학적 접근 — 철학자를 고용해 모델의 가치관과 페르소나를 정립한 것이 업계의 판도를 바꿈
- 기계적 해석력 — 모델의 신경망을 정밀하게 분석하고 제어하여 특정 개념을 고정하는 기술적 우위
Claude와 대화하면서 무언가 눈치챘습니다. Claude는 다른 LLM들과 비교했을 때 훨씬 더 개성 있고 독특한 말투를 가지고 있습니다. Sonnet 4.5에 사용한 것과 똑같은 시스템 프롬프트를 Qwen3.5 27B에 넣어봤지만 행동 방식에 변화가 없었기에, 시스템 프롬프트가 핵심적인 역할을 하는 것은 아니라고 결론 내렸습니다.
Claude의 응답이나 사고 과정을 다른 모델에 증류(distill)했다고 주장하는 많은 모델을 봤지만, 테스트 결과는 꽤나 실망스러웠습니다. 제가 놓친 부분이 있을지도 모르겠지만(그렇다면 사과드립니다), 다음과 같은 질문을 던지는 것은 정당하다고 생각합니다.
왜 우리는 Claude처럼 말하는 모델을 만들 수 없는 걸까요?
이건 추론의 문제가 아니라 단순히 말하는 '스타일'과 '분위기'의 문제입니다. 심지어 Claude의 API나 웹 UI에서도 숨겨진 것이 아니죠. 아무리 노력해도 Claude처럼 말할 수 없게 만드는 아키텍처의 차이가 있는 걸까요? 아니면 모델 크기와 적절한 시스템 프롬프트의 조합(200B 이상의 모델을 제대로 프롬프트하면 Claude처럼 말할 수 있을까요) 문제일까요?
시스템 프롬프트를 너무 오랫동안 시도해 봤지만, 모델은 항상 다음을 놓치는 것 같습니다:
- 서식(Claude는 이모지를 피하고 다른 모델들과 달리 불렛 포인트를 최대한 사용하지 않으려 합니다)
- 응답 길이(때로는 Satin이 무엇인지에 대해 5문단 동안 장황하게 늘어놓다가도, Gated DeltaNets에 대해서는 1문단으로 끝내버리기도 합니다)
감사합니다!



