Claude Code에서 Kimi-K3 사용해 본 후기
Kimi-K3 in Claude Code
핵심 요약
Claude Code에서 Kimi-K3를 사용해 본 결과 성능은 만족스럽지만, 속도가 느리고 비용 효율성이 낮다는 평가입니다.
- 성능 평가 — Opus 4.8과 Fable 사이의 준수한 성능을 보여줌
- 속도 문제 — 일반적인 작업 대비 2배 이상 느린 응답 속도
- 비용 효율성 — 구독제 대비 API 사용료가 지나치게 비싸게 느껴짐
- 사용자 반응 — 구독제와 API 요금 체계 비교 방식에 대한 논쟁 발생
다들 안녕,
이번 주말에 내 Max 20x 주간 한도가 거의 다 떨어져 가더라고. 화요일 정오에나 리셋되는데 말이야. 마침 Kimi-K3 나온다고 난리길래, Anthropic에서 강제로 쉬게 된 김에 이 건방진 신입 녀석을 한번 써보기로 했지.
내가 지금 브라우저 기반 CAD 앱을 하나 만들고 있거든. 기능 구현은 꽤 깔끔하게 덩어리로 나뉘어 있어. 여기랑 미디엄에서 읽은 것들로 나만의 플레이북을 만들었는데, 대충 이래: PRD 브레인스토밍, 아키텍처 설계, 설치 계획, 적대적 검토, 통합, 코드 작성, 자동 정리, 자동 테스트, 사용자 워크스루, 커밋, 문서화. 나 전문 개발자는 아닌데, 나름 감은 좀 있고 제품 관리 비전도 확실해서 이걸 개발 가능한 시스템으로 쪼개는 건 잘해. three.js를 렌더링 기반으로 쓰는 npm 의존성 잔뜩 들어간 Typescript 프로젝트야.
OpenRouter 같은 거 쓰는 대신 그냥 Kimi API를 직접 뚫기로 했어. 걔네가 살짝 더 얹어주기도 하니까.
Chat-GPT랑 Opus 4.8한테 K-3 세팅하는 법 물어보니까 아주 친절하게 알려주더라. Anthropic Claude Code 세션에서 사용 가능한 모델로 돌릴지, 아니면 아예 메인 모델로 쓸지 선택할 수 있었는데, 난 후자를 골랐어. Anthropic 쪽은 이미 연료가 거의 바닥이었거든.
AI 조언자들이 실제 작업 들어가기 전에 K-3로 전체 테스트 환경부터 돌려보라길래, 상세 체크리스트까지 짜줬어: 파일 읽기/수정, bash 실행, 서브 에이전트 실행, 계획/코딩/테스트 같은 모드들, MCP, 스킬, Repo/Git 제어, 아티팩트 생성, 스크린샷 읽기, Claude.md랑 Claude-Context.md 같은 문서 읽고 따르기, Vite 제어 등등. CC/Anthropic 모델에서 하던 거랑 똑같이 다 잘 돌아가더라. Claude-in-Chrome MCP 설정할 때 좀 까다롭긴 했는데, 그건 내가 탭 관리 제대로 안 해서 그런 거라 뭐. 나머지는 테스트 다 통과했고 실전에서도 문제없었어.
아까 말했듯이 내 앱 작업은 독립적인 단위로 쪼개기 쉬워서, 그룹 내 미러링 기능 만드는 작업을 하나 해보기로 했지.
그래서 이 기능에 대해 플레이북대로 진행해 봤는데, 아주 잘 돌아가더라고. 평소처럼 단계별로 착착 진행했어. UI가 도면이랑 상호작용하는 방식에 결함이 있다는 것도 프로세스 도중에 발견했고. 덕분에 잠깐 멈추고, 다시 생각해서 수정하고, 커밋까지 완료했지. 아주 훌륭했어. Opus 4.8이랑 Fable 사이 어딘가쯤 되는 성능이라고 보는데, 이건 뭐 지극히 주관적인 거니까.
근데, 진짜 엄청나게 느려. 작업 시간이 평소 예상보다 두 배는 더 걸린 것 같아. 세 시간 넘게 걸렸거든. 평소 세팅대로라면 한 시간에서 한 시간 반이면 끝날 일인데 말이야. 프롬프트 넣고 답변이나 동작이 돌아오기까지 전부 다 한참 걸리더라고. 작업 종류 가릴 것 없이 다 그랬어. 아마 긍정적인 평가 때문에 Kimi 서버에 사람이 몰려서 터져나가는 중인가 봐. 정확히는 모르겠지만, 응답 대기열에서 기다리는 건지 아니면 추론 자체가 느린 건지 알 수가 없었어.
그리고 또 하나, 비용이 너무 비싸. 아까 말했듯이 난 Anthropic Max 20x 구독 중이거든. 프로젝트는 파트타임으로 하지만 가능한 한 많이 매달리는 편이야. 시간 좀 날 때 빡세게 하면 보통 5~6일이면 주간 한도 다 채우거든. 그러니까 내 사용 패턴은 대충 파악하고 있는 셈이지. 예전에 내 플랜에 50달러 추가 크레딧을 넣은 적이 있는데, 지금이랑 똑같은 작업 방식으로 2시간도 안 돼서 다 태워 먹었어. 구독 플랜이 단품 결제보다 훨씬 저렴하다는 거 말고는 대체 왜 이런 건지 도통 모르겠네.
Kimi 계정에 100달러 넣으니까 5% 더 얹어주길래 105달러로 시작했거든. 테스트 돌리는 데만 15달러 정도 나갔고, 나머지 세션 진행하는 데 73달러 정도 썼어. 와, 일주일 치 구독료보다 훨씬 많이 쓴 셈이지. 게다가 속도까지 엄청 느리고 말이야.
결과물 퀄리티는 진짜 대만족임. 근데 속도랑 비용은 좀 아니네. 내가 잘못 쓰고 있는 거면 좋겠다. 아니면 내 즉흥적인 API 비용 예상이 틀린 거였으면 좋겠고. 혹시 조언이나 통찰 좀 줄 사람?
보고는 여기까지. Kimi 서브레딧에나 올려볼까 함. 또 도움 될 만한 다른 서브레딧 있을까?


