llama.cpp의 Gemma 4 수정 사항
Gemma 4 fixes in llama.cpp
핵심 요약
Gemma 4의 초기 오류는 모델 자체의 결함이 아니라 llama.cpp의 업데이트가 필요한 상황이었음.
- llama.cpp 업데이트 — 모델 출시 직후에는 관련 수정 사항이 반영될 때까지 며칠 기다려야 함.
- 섣부른 판단 자제 — 버그가 수정되기 전까지는 모델의 성능이나 품질에 대해 평가를 보류해야 함.
- 커뮤니티 협력 — 버그를 조기에 발견하고 수정하기 위해 커뮤니티 차원의 테스트가 중요함.
- 최신 빌드 권장 — llama.cpp는 업데이트가 매우 빠르므로 최신 소스에서 직접 빌드하는 것이 좋음.
Gemma가 잘 작동하지 않아서 별로라는 의견들이 벌써 나오고 있는데, 아마 transformers 구현체를 안 쓰고 llama.cpp를 쓰고 있어서 그럴 거임.
모델이 출시되면 llama.cpp에서 모든 수정 사항이 반영될 때까지 최소 며칠은 기다려야 함. 예를 들면 이런 것들:
https://github.com/ggml-org/llama.cpp/pull/21418
https://github.com/ggml-org/llama.cpp/pull/21390
https://github.com/ggml-org/llama.cpp/pull/21406
https://github.com/ggml-org/llama.cpp/pull/21327
https://github.com/ggml-org/llama.cpp/pull/21343
...그리고 더 나올지도 모름?
채팅할 때 루프 문제가 있었는데, OpenCode에서 이것저것 해보니까(코딩도 아니었음) 아무 문제 없었음. 그러니까 GLM Flash 때처럼 더 나은 프롬프트가 어떻게든 오버싱킹/루핑 문제를 해결해 주는 듯.

