Qwen 3.6 27B 모델, 에이전트 작업에서 완전히 실패함
Qwen 3.6 27B absolutely fails at agentic work
핵심 요약
Qwen 3.6 27B 모델이 에이전트 작업에서 잦은 오류를 일으키는 문제를 논의하며, 설정 최적화 방안을 찾습니다.
- 모델 성능 저하 — 27B 모델이 에이전트 작업 시 지시를 따르지 않고 엉뚱한 행동을 반복함
- 설정 최적화 — 'preserve_thinking' 옵션 활성화가 모델의 논리적 일관성 유지에 필수적임
- 추가 설정 제안 — '--swa-full' 옵션 추가 및 시스템 프롬프트 간소화가 성능 개선에 도움됨
- 지속되는 문제 — 설정 변경 후에도 여전히 환각 현상과 파일 삭제 등 치명적인 오류가 발생함
Qwen 3.5 122B 모델을 4비트로 꽤 오랫동안 돌려왔고, 최근에는 Llama.cpp가 VLLM과 비슷한 성능을 내게 되면서 5비트로 돌리기 시작했습니다.
또한 Qwen 3.6 27B 모델이 122B보다 낫다는 주장이 많아서 8비트와 16비트로 여러 번 시도해 보았습니다.
단일 프롬프트에서는 확실히 더 낫긴 합니다. 매우 인상적인 데모 HTML 페이지를 출력해 주거든요. 3.5 시리즈 모델보다 훨씬 긴 콘텐츠를 생성할 수 있는 능력도 갖추고 있습니다.
하지만 에이전트 작업에서는 완전히 무너집니다. 끊임없이 실수를 저지르고 지시를 따르지 않습니다. 모델이 엉망으로 만들지 않게 할 방법이 없네요. 4번 정도 턴이 지나면 완전히 멍청한 짓을 합니다.
저만 이렇게 느낀 건가요? 27B를 어떻게든 써보려고 다시 시도했다가 결국 122B로 돌아왔습니다.
Llama.cpp, Git에서 나이트리 빌드, RTX 6000 사용 중입니다.


