원시인 버전 Qwen3.6 27B
A caveman qwen3.6 27B
핵심 요약
토큰 사용량을 90% 줄였다고 주장하는 'Grug' 모델에 대한 커뮤니티의 관심과 초기 테스트 후기.
- 모델 성능 논란 — 벤치마크 수치는 높지만 실제 추론 능력은 저하됨
- 토큰 효율성 — 기존 모델 대비 90% 이상의 토큰 절감을 목표로 함
- 원시인 컨셉 — 모델이 원시인처럼 말하고 생각하도록 튜닝됨
- 실제 사용 후기 — 복잡한 추론이 단답형으로 축소되어 성능이 아쉽다는 평가
방금 허깅페이스에서 이거 봤음: https://huggingface.co/ProCreations/grug-27b
벤치마크 주장으로는 기존 Qwen3.6 27B보다 꽤 낫고 필요한 토큰 양을 90% 이상 줄였다고 함. 사실이라면 내 구형 노트북에서 3tps로 돌아가던 27B가 생각하는 부분에서는 30tps처럼 느껴질 듯.
아직 테스트는 못 해봄.

