llama-server에 Gemma-4 기반 오디오 처리 기능 추가
Audio processing landed in llama-server with Gemma-4
핵심 요약
llama.cpp 서버에서 Gemma-4 모델을 활용한 로컬 STT 기능이 공식 지원됨.
- STT 기능 지원 — llama-server에서 Gemma-4 E2A/E4A 모델을 통한 음성 인식 가능
- 로컬 처리 환경 — 별도 파이프라인 없이 로컬에서 음성 에이전트 구축 가능
- 성능 논쟁 — 기존 Whisper나 Parakeet 대비 성능 및 언어 지원 범위에 대한 의견 분분
- 현재 한계점 — 긴 오디오 처리 시 오류 발생 등 아직 개선이 필요한 초기 단계
신사 숙녀 여러분, llama.cpp(llama-server)가 이제 Gemma-4 E2A 및 E4A 모델을 사용한 STT를 지원한다는 소식을 전하게 되어 매우 기쁩니다.

