커스텀 Llama.cpp 빌드(RTX 5080)에서 Qwen3.6 35B(2분) vs Muse Glimmer 30B(4분) 비교
Qwen3.6 35B (2 min) vs Muse Glimmer 30B (4 min) on custom Llama.cpp build (RTX 5080)
핵심 요약
Qwen3.6 35B와 Muse Glimmer 30B의 성능 및 창의성 비교 테스트 결과입니다.
- 모델 비교 — Qwen3.6은 창의적이고 복잡한 작업에 강점이 있고, Muse Glimmer는 정확성과 신뢰성이 높음.
- 빌드 환경 — RTX 5080 환경에서 최신 Llama.cpp 및 CUDA 13.1을 사용하여 벤치마크 수행함.
- 사용자 반응 — Muse Glimmer의 신뢰성을 높게 평가하는 의견과 Qwen 27B와의 비교가 적절하다는 지적이 공존함.
- 오픈 소스 — Muse Glimmer는 Apache 2.0 라이선스로 완전 오픈 소스라는 점이 주목받음.
Muse Glimmer 30B는 훨씬 더 정확하고 신뢰할 수 있다고 느껴지며, 거의 실수를 하거나 규칙을 어기는 일이 없습니다. 하지만 디자인 면에서는 창의적인 깊이와 풍부함이 부족합니다.
반면 Qwen3.6 35B는 가끔 더 많은 실수나 환각을 일으키는 경향이 있지만, 창의적인 결과물은 더 뛰어납니다. 훨씬 더 풍부하고 복잡한 복셀(voxel) 세계를 생성하며 더 높은 디자인 품질을 제공합니다.
LLama.cpp 빌드 출처:
- **Base:** llama.cpp upstream (merge 4445f8d, build 661)
- **CUDA Toolkit 13.1** + MSVC 19.44 + `sm_120a-real` (native Blackwell PTX)
- **Flags:** `GGML_CUDA=ON`, `GGML_CUDA_FA=ON`, `GGML_CUDA_FA_ALL_QUANTS=ON`, `GGML_CUDA_GRAPHS=ON`, `GGML_NATIVE=OFF`
- **License:** MIT (upstream llama.cpp)
Qwen3.6이 여전히 이 분야의 독보적인 왕이라고 생각하시나요?



