model: openPangu-2.0-Flash (92B-A6B) 추가 - MLA-latent 캐시, DSA/SWA, mHC 및 멀티 헤드 MTP 지원 (joelfarthing의 ik_llama.cpp PR #2065)
model: add openPangu-2.0-Flash (92B-A6B) with MLA-latent cache, DSA/SWA, mHC, and multi-head MTP by joelfarthing · Pull Request #2065 · ikawrakow/ik_llama.cpp
핵심 요약
ik_llama.cpp에 openPangu-2.0-Flash 모델 지원이 추가되었으며, 사용자들은 모델의 성능과 효율성에 대해 논의 중입니다.
- 모델 지원 — openPangu-2.0-Flash 92B 모델이 ik_llama.cpp에 추가됨
- 기술적 특징 — MLA-latent 캐시, DSA/SWA, mHC 및 멀티 헤드 MTP 적용
- 사용자 반응 — 모델 성능과 구현 안정성에 대한 의문 제기됨
- 향후 전망 — 500B 모델 지원을 위한 사전 단계로서의 가치 평가
github.com
원문 사이트로 이동
[블록 1/3] openPangu-2.0-Flash - 92B A6B & 512K 컨텍스트 길이
[블록 2/3] 모델 : https://huggingface.co/openpangu/openPangu-2.0-Flash/blob/main/README_EN.md
[블록 3/3] ik_llama 사용자를 위한 GGUF : https://huggingface.co/ji-farthing/openPangu-2.0-Flash-ik-llama-GGUF

