DeepSeek V4 Flash / MiniMax M3의 llama.cpp 지원은 언제쯤 기대할 수 있을까요?
When can we expect merged DeepSeek V4 Flash / MiniMax M3 llama.cpp support?
핵심 요약
DeepSeek V4 Flash와 MiniMax M3의 llama.cpp 공식 지원 시점과 대안 도구에 대해 질문하는 글입니다.
- 모델 지원 현황 — DeepSeek V4 및 MiniMax M3 관련 PR이 현재 진행 중임.
- llama.cpp 개발 속도 — 새로운 모델 지원이 늦어지는 이유와 이에 대한 비판적 의견이 있음.
- 대안 도구 — vLLM이나 특정 최적화 도구 사용이 언급됨.
- 커뮤니티 반응 — llama.cpp가 죽어가고 있다는 주장에 대해 반박과 팩트체크가 이어짐.
저는 이 커뮤니티에 비교적 새로 왔고, 지원 개발에 시간이 얼마나 걸리는지에 대한 경험이 거의 없습니다. 포크(fork)들이 있다는 건 알지만, 병합되지 않았다는 건 제가 알기로는 지원이 완벽과는 거리가 멀다는 뜻입니다.
llama.cpp에서 DeepSeek V4 Flash 및/또는 MiniMax M3에 대한 안정적인 전체 지원을 언제쯤 기대할 수 있을까요?
아니면, 이미 그런 지원을 제공하는 다른 도구가 있을까요? 예를 들어, 저는 vLLM을 전혀 시도해 본 적이 없고 llama.cpp와 koboldcpp만 사용해 봤습니다.
미리 감사드립니다.


