Gemma4_31b_fp8이 내 테스트 환경에서 Sonnet_4.6_medium과 대등한 성능을 보여줌
Gemma4_31b_fp8 keeping up with Sonnet_4.6_medium in my harness.
핵심 요약
Gemma4_31b_fp8 모델이 다양한 실무 작업에서 Sonnet_4.6_medium과 비슷한 성능을 기록함.
- 성능 비교 — Gemma4_31b_fp8이 Sonnet_4.6_medium과 대등한 수준을 보임
- 테스트 항목 — 그래프 쿼리, 엔티티 추출, 에이전트 도구 호출 등 다양한 작업 수행
- 모델 최적화 — FP8 양자화 환경에서 우수한 성능을 입증함
-
그래프 탐색을 위한 Cypher 쿼리 (neo4j)
-
텍스트 청크에서 엔티티 추출 (웹 쿼리, 그래프 쿼리, 벡터)
-
에이전트 도구 호출 (스킬 선택 / Pi에서 성공적인 실행)
-
코드 작성 (Python)
-
다중 벡터 검색의 합성/요약
Gemma/Qwen in FP8.
이 결과가 나를 기쁘게 함


