Claude를 Qwen 3.8 Next로 대체한 지 4~5일 차
4-5 days replacing Claude w Qwen 3.8 Next
핵심 요약
Mac Studio에서 로컬 모델을 구동해 Claude를 대체한 경험과 성능에 대한 공유입니다.
- 로컬 모델 전환 — Claude를 Qwen 3.8 Next로 대체하여 연구 및 업무에 활용함
- 하드웨어 성능 — M1 Ultra 128GB 환경에서 충분한 작업 효율을 확인함
- 개인정보 보호 — 클라우드 모델이 사용자를 너무 잘 파악하는 것에 대한 거부감 해소
- 최적화 고민 — 속도와 정확도 사이의 균형을 맞추기 위한 로컬 환경 최적화 진행 중
안녕, 그냥 잡담 좀 하러 온 사람이야. 읽기 싫으면 넘겨도 돼.
전반적으로 딱히 아쉬운 건 없어. 오히려 더 나은 것 같기도 하고. 내 하드웨어(M1 Ultra, 128GB 램)에서는 Claude만큼 빠르진 않겠지만, 연구나 다른 업무 관련 작업에 opencode를 써보니까 일 처리도 잘 되고 학습도 잘 되더라.
클라우드 제공업체 써서 속도 높이는 멀티 에이전트 워크플로우 쪽으로 다시 파볼까 생각 중이야. 지금은 커스텀 하네스를 다듬으면서 슬롯을 이것저것 설정하고 있는데, 이게 채팅용으로는 괜찮은데 진짜 재밌고 유용한 기능들까지 다 커버하진 못하거든. Claude가 나를 더 "잘 알긴" 했는데, 몇 달 동안 계속 대화했으니 당연한 거겠지. 근데 솔직히 걔네가 나를 그렇게까지 잘 아는 게 좋은 건지도 잘 모르겠어.
댓글이 많이 달릴 거라 기대는 안 하지만, 1조 원짜리 기업이 제공하는 서비스를 맥 스튜디오랑 무료 소프트웨어로 대체할 수 있다는 게 진짜 개쩌는 것 같아.
정확도 안 깎아먹으면서 시스템 속도 최적화할 팁 좀 있을까?
DeepSeek V4 0731이랑 GLM Flash 최적화도 해보려고 했는데, Qwen 3.8 next보다 딱히 "더 나은" 것 같지가 않더라고. 그래서 프리필(prefill)이나 초당 토큰 수(tokens per second) 최적화에 매달리는 것보다 그냥 직접 써보는 데 시간을 더 쓰기로 했어.
