Kimi K3가 역대 최대 규모의 오픈 웨이트 모델로 출시됨. 하지만 여전히 직접 돌릴 수는 없음.
Kimi K3 is the largest open-weight model ever released. You still can't run it.
핵심 요약
역대 최대 규모인 2.8조 파라미터의 Kimi K3가 공개되었으나, 엄청난 하드웨어 요구 사양으로 인해 일반적인 환경에서의 직접 구동은 사실상 불가능함.
- 모델 사양 — 2.8조 파라미터와 100만 토큰 컨텍스트 윈도우를 갖춘 고성능 모델임.
- 하드웨어 장벽 — 1.4TB 저장 공간과 다수의 엔터프라이즈급 GPU가 필요해 개인이 돌리기 어려움.
- 오픈의 의미 — 모델 가중치는 공개되었으나 추론 환경과 데이터 통제권은 여전히 API에 의존함.
- 비용 논쟁 — 하드웨어 구축 비용을 두고 수만 달러에서 수백만 달러까지 의견이 갈림.
Moonshot이 오늘 Kimi K3 오픈 웨이트를 공개함. 2.8조 파라미터, 수정된 MIT 라이선스. 벤치마크는 확실히 인상적임. BrowseComp에서 91.2%를 기록하며 출시 시점 기준 최고의 에이전트 성능을 보여줌. 새로운 어텐션 아키텍처 덕분에 100만 토큰 컨텍스트 윈도우가 실제로 빠른 속도로 작동함.
하지만 셀프 호스팅을 하려면 1.4TB의 저장 공간과 18개 이상의 엔터프라이즈 GPU가 필요함. 요청 하나를 처리하기 전 가중치를 로드하는 데만 이 정도가 필요함. Blackwell이나 MI400급 장비가 필요한 수준임. 하이퍼스케일러나 자금력이 충분한 연구소 밖에서는 아무도 이걸 로컬에서 돌릴 수 없음.
그래서 실제로는 Kimi K3를 "오픈"이라고 부르는 사람들 대부분이 그냥 API를 쓰고 있음. 다른 곳들보다 사정이 좀 낫긴 하지만, 결국 중국 호스팅 엔드포인트임.
오픈 웨이트라는 건 모델을 읽을 수 있다는 뜻이지, 추론 계층이나 데이터를 통제할 수 있다는 뜻은 아님. 대형 오픈 웨이트 모델이 나올 때마다 이 간극이 계속 무시되고 있는데, 이런 모델들이 자율 에이전트 워크플로우에 사용될수록 이 문제가 더 중요해진다고 생각함.
그래서... 여기 실제로 이걸 셀프 호스팅할 계획인 사람이 있는지, 아니면 다들 그냥 API를 기본으로 쓰고 있는지 궁금함.


