K2-Horizon-MoVA-36B-A4B 모델 써보신 분 계신가요? 사용 사례가 궁금합니다.
Is anyone using K2-Horizon-MoVA-36B-A4B? If yes, what is the usecase?
핵심 요약
새로 출시된 MoVA 모델의 성능과 사용 환경, 특히 VRAM 효율성과 벤치마크에 대한 사용자들의 기술적 논의가 이어지고 있습니다.
- 성능 및 최적화 — VRAM에 모델을 완전히 올리면 매우 빠르지만 KV 캐시 요구량이 커서 컨텍스트 제한이 발생함
- 기술적 구현 — llama.cpp 지원 미비 및 mlx-lm 환경에서의 패치 필요성 등 구동 난이도가 존재함
- 모델 비교 — Qwen3.8-27B 등 기존 모델과의 속도 및 효율성 비교가 활발히 진행됨
- 벤치마크 공유 — LLM-bench.io를 통한 모델 성능 비교 데이터가 커뮤니티의 주요 관심사로 떠오름
며칠 전에 MoE 클럽에 새로운 모델 하나가 들어왔더라. 이거 써본 사람 있냐? 아니면 쓸만한 이유라도 찾은 사람 있음?
모델 비교 상세 내용은 여기 => https://llm-bench.io/compare/models?models=ornith-1-5-35b-a3b-oq4e-mtp%2Ctiel-coder-35b-a3b-mlx-oq4e-mtp%2Ck2-horizon-mova-36b-a4b-mlx-4bit


