Claude Code를 사용하면서 코딩 작업은 Mistral/DeepSeek에 위임하기: 10일간 5,700만 토큰 절약 및 비용 90% 이상 절감
I used Claude Code to build while delegating coding to Mistral/DeepSeek - 10 days, 57M tokens saved, over 90% costs savings, Claude quality result
핵심 요약
Claude Code의 계획 능력은 유지하면서 코딩 작업만 저렴한 모델로 위임해 비용을 90% 이상 절감한 사례.
- 비용 절감 — Claude Code의 계획 능력은 유지하고 코딩 작업만 저렴한 모델로 위임해 비용을 90% 이상 절감함.
- 성능 유지 — Claude가 작업을 분해하고 결과물을 검토하여 98%의 높은 성공률을 기록함.
- 모델 유연성 — Mistral Pro 구독을 활용하거나 DeepSeek Flash를 사용하여 토큰 비용을 획기적으로 낮춤.
- 오픈소스 도구 — 작성자가 공개한 vibe-skill을 통해 직접 워크플로우를 구성하고 자동화할 수 있음.
저는 Claude Code 스킬인 vibe-skill(https://github.com/pcx-wave/vibe-skill)을 운영하고 있습니다. 이 스킬은 Claude 토큰을 낭비하는 대신 코딩 작업을 Mistral Vibe에 위임합니다. 처음에는 Pro 플랜에서 세션 제한에 너무 빨리 걸리는 걸 견딜 수 없어서 시작했지만, Claude의 계획 능력이라는 품질은 잃고 싶지 않았습니다. 10일간 사용한 결과를 정리해 드립니다.
작동 방식: /vibeon <작업내용>을 입력하면 Claude가 작업을 분해하고 코딩을 Vibe에 위임합니다. Claude는 diff를 검토하고 필요하면 수정합니다. Vibe의 토큰 소모는 저렴한 모델에서 이루어집니다.
Vibe는 모델에 구애받지 않아서 기본 모델(Mistral medium 3.5)과 Deepseek vs flash로 테스트해 봤습니다.
10일간의 결과(254회 실행, 5,700만 토큰 위임)
모델별 결과:
| 모델 | 토큰 | 실제 비용 | Claude 환산 비용 | 절감액 |
|---|---|---|---|---|
| DeepSeek V4 Flash | 29M | $4.13 | $92.16 | 95% |
| Mistral Medium 3.5 | 28M | $0 (Pro 구독) | $84.77 | 100% |
98%의 성공률을 보였습니다. 실패할 경우 Claude가 이를 포착하여 수정합니다.
Mistral 토큰은 보통 Claude보다 50% 저렴하고, DeepSeek 토큰은 95% 더 저렴합니다. 하지만 저는 Mistral Pro 구독자라서 구독에 포함된 대량의 무료 토큰(약 10억 개)을 제공받습니다. 그래서 Mistral Pro를 사용하면 할당량에 도달할 때까지 모든 위임 비용은 $0입니다. 할당량을 초과하면 즉시 DeepSeek로 전환합니다(Mistral PAYG는 100만 토큰당 $1.52로 DeepSeek보다 10배 비쌉니다).
그렇다면 월간 사용량이 어느 정도일 때 DeepSeek 단독 사용 비용이 Mistral 구독료보다 비싸질까요?
$18.36(Mistral 구독료) / $0.14(100만 DeepSeek 토큰당 비용) = 1억 3,100만 토큰/월
1억 3,100만 토큰 미만이라면 DeepSeek 단독 사용이 더 저렴하므로 Mistral 구독이 필요 없습니다. 그 이상이라면 Mistral Pro가 유리하며, 할당량에 도달하기 전까지 약 10배 더 많은 여유를 가질 수 있습니다.
오케스트레이션 흐름에 대한 자세한 내용은 저장소에서 확인하세요: https://github.com/pcx-wave/vibe-skill
Gemini도 저렴한 토큰을 제공한다는 걸 알고 있어서 비슷한 스킬(https://github.com/pcx-wave/gemini-skill)을 만들었지만, Gemini는 Vibe만큼 설정이 자유롭지 않아 위임이 다소 불안정할 수 있어 아직 많이 사용해보지는 않았습니다.


