중국인으로서 한마디 해야겠습니다
I have to say something as a chinese
핵심 요약
중국 AI 커뮤니티의 관점에서 Anthropic의 최근 비난이 과장되었거나 맥락이 결여되었다고 주장하는 글입니다.
- 경제적 비효율성 — 저렴한 모델인 DeepSeek의 요청을 Claude로 우회시키는 것은 경제적으로 말이 안 됨
- API 리셀러 문제 — 오히려 중국 내 Claude 리셀러들이 비용 절감을 위해 Claude 요청을 다른 모델로 돌리는 경우가 많음
- 경쟁적 벤치마킹 — 타사 모델을 연구하고 벤치마킹하는 것은 일반적인 엔지니어링 관행일 뿐임
- 사용자 차별 — 중국인이라는 이유만으로 잠재적 악당 취급을 받으며 양쪽에서 억압받는 현실에 대한 피로감 토로
중국인으로서 어릴 때부터 입조심하라고 배웠다는 걸 알아줬으면 해. 안 그러면 곤란해지니까, 꼭 필요한 상황이 아니면 말을 아끼는 게 상책이지.
중국 AI 커뮤니티 사정을 잘 아는 사람으로서, 최근 앤스로픽(Anthropic)이 내놓은 주장들에 대해 몇 마디 하려고 해. 솔직히 말해서 그쪽 프레임은 오해의 소지가 다분하거나 맥락을 완전히 놓치고 있어. 몇 가지 짚어볼게.
첫째, 딥시크(DeepSeek)처럼 저렴한 모델이 자기네 요청을 클로드(Claude)로 상습적으로 넘긴다는 건 경제적으로 말이 안 돼. 이건 생수 주문했는데 공짜로 와인을 주는 격이거든.
실제로는 정반대야. 앤스로픽의 접근 제한 정책 때문에 클로드를 써야 하는 중국 사용자들은 어쩔 수 없이 서드파티 API 업체를 이용해. 근데 악질적인 업체들은 비용 아끼려고 요청 일부를 더 싼 모델로 돌리는 '꼼수'를 부려. 리셀러를 통해 요청 10개를 보내면, 8개는 클로드로 가고 2개는 몰래 다른 데로 새는 식이지. 이런 식의 바꿔치기는 분명 문제지만, 앤스로픽이 주장하는 방향과는 정반대야. 딥시크나 키미(Kimi)가 클로드로 요청을 보내는 게 아니라, 누군가 클로드를 이용해 장난질을 치는 거라고.
둘째, 군사 및 생화학 무기 관련 예시 말인데, 이미 다른 중국 블로거들이 올린 자료를 보면 인용된 프롬프트 중 일부는 대학 시험 문제였고 온라인에 공개된 것들이야. 내가 본 건 앤스로픽이 주장하는 것뿐이었어.
셋째, '대규모 증류(massive distillation)'에 대해서는, 그래, 중국 연구소들이 다른 최첨단 모델의 결과물을 연구하는 건 맞아. 하지만 모델과 학습 파이프라인을 독자적으로 구축하면서 엔지니어들이 경쟁사 모델을 벤치마킹하고 그 동작 방식을 연구하는 건 지극히 평범한 경쟁 연구야. 중국 기업들도 증류를 하긴 하지만, 기껏해야 10% 정도고 나머지는 다 자기들이 직접 해.
이걸 다 묶어서 '대규모 증류'라고 부르는 건, 포드 엔지니어들이 혼다 차를 사서 어떻게 돌아가는지 뜯어봤다고 중죄를 저질렀다고 하는 거나 다름없어. 경쟁사 벤치마킹은 거의 모든 엔지니어링 산업에서 일상적인 일이라고.
넷째, '수만 개의 계정' 운운하는 것도 맥락을 봐야 해. 중국 AI 사용자들은 해외 서비스 쓰려면 VPN이 필수거든. 그래서 수많은 무관한 사용자들이 같은 VPN 업체나 IP 대역, 출구 노드를 거치게 되니까 한 사람처럼 보이는 거야.
물론 그렇다고 해서 부정 사용이 전혀 없었다는 건 아니야. 하지만 증거를 해석할 때는 신중해야 한다는 거지. API 오남용, 리셀러의 모델 바꿔치기, 경쟁사 벤치마킹, 그리고 체계적인 모델 추출은 완전히 다른 문제들이야. 이걸 뭉뚱그려서 섞어버리면 안 되지.
난 중국 공산당을 옹호하려는 게 아니야. 그냥 공산당한테 억압받는 동시에 앤스로픽한테까지 억압받는 상황이 지긋지긋할 뿐이야. 앤스로픽은 최첨단 AI를 써보고 싶어 하는 수많은 사람을 마치 악마처럼 취급하면서, 중국인과 중국 기업 전체를 악마화하고 있어. 모든 중국인을 악으로 규정하고, 우리 서비스 접근 시도를 전부 자기들에 대한 위협으로 간주하는 꼴이지.
한 가지 더 덧붙이자면, 앤스로픽이 키미가 사용자들의 어려운 요청을 무작위로 클로드로 넘긴다고 주장하는 건 기술적으로나 경제적으로나 말이 안 돼.
일단 클로드와 중국 모델들은 **토크나이저(tokenizer)**가 다르고, 더 중요한 건 **KV 캐시(KV caches)**와 모델 내부 상태가 호환되지 않아. 키미가 문제 풀다가 중간에 멈추고 그 추론 상태를 그대로 클로드한테 넘겨줄 수는 없다는 소리야. 기껏해야 대화나 프롬프트를 클로드에 다시 보내서 처음부터 새로 추론을 시작하는 게 전부지.
이건 어려운 작업을 하다가 소넷(Sonnet)에서 오퍼스(Opus)로 바꾼다고 해서 소넷이 쌓아둔 추론 상태가 마법처럼 오퍼스에게 이어지지 않는 것과 같아. 오퍼스로 새로 세션을 시작하면 결과가 완전히 다르게 나올 수도 있거든.
둘째, 만약 중국 AI 기업이 진짜로 증류(distillation)를 위해 Claude의 결과물을 원했다면, 서드파티 API를 통해 Claude에 접근해서 훨씬 깔끔하고 가치 있는 학습 데이터를 의도적으로 뽑아냈을 거다. Kimi 일반 사용자들의 개판인 프롬프트를 무작위로 골라내서 Claude 수준의 비싼 돈을 내고 처리하는 건, 증류 데이터를 모으는 방식치고는 극도로 비효율적이고 돈만 날리는 짓이다.
다시 말하지만, 나는 그들이 증류를 아마 할 거다. 내가 하는 말은 Anthropic이 는 거다. 기술적, 경제적 유인을 조금만 따져봐도 이 특정 혐의는 앞뒤가 전혀 안 맞는다.

