Qwen3.6이 로컬 에이전트용 모델 중 끝판왕인가?
Is Qwen3.6 current king for local agentic use?
핵심 요약
Qwen3.6 35B 모델이 로컬 에이전트 작업에서 루프 현상 없이 가장 뛰어난 성능을 보여준다는 사용자 경험 공유.
- 성능 비교 — Qwen3.6 35B가 Gemma4나 GLM 4.7보다 에이전트 작업에서 루프 현상이 적고 안정적임.
- 모델 추천 — 35B급 MoE 모델 중 에이전트용으로 쓸만한 대안을 찾고 있음.
- 채팅 템플릿 — 기본 템플릿보다 커스텀 템플릿을 적용해야 에이전트 및 툴 호출 성능이 개선됨.
- 하드웨어 논쟁 — 로컬 환경에서 고성능 모델을 돌리기 위한 VRAM/RAM 요구 사양에 대해 의견이 갈림.
다른 모델들도 테스트해봤지만, 에이전트 용도로는 Qwen3.6 35B A3B만한 게 없는 것 같음. 가끔 루프에 빠지는 게 최악인데, Gemma4는 가끔 툴 호출이 깨지고 GLM 4.7 Flash REAP은 2~3번 메시지 주고받으면 바로 루프에 빠짐. 전부 Unsloth에서 받은 IQ4_NL 퀀트 모델임.
비슷한 사이즈(가급적 MoE) 모델 중에 아직 안 써본 더 좋은 모델이 있는지 궁금함. Hermes Agent랑 Pi에 쓰고 있는데 완벽하진 않아도 로컬 모델치고는 미친 수준으로 좋음.

