3x3090(72GB VRAM)에서 구동한 Mistral-Medium-3.5-128B-Q3_K_M 성능
Mistral-Medium-3.5-128B-Q3_K_M on 3x3090 (72GB VRAM)
핵심 요약
3개의 3090 GPU를 활용해 Mistral-Medium 모델을 로컬에서 구동한 성능 테스트 결과 공유.
- 로컬 구동 성능 — 3개의 3090 GPU를 사용하여 128B 파라미터 모델을 Q3 양자화로 실행함.
- 코드 생성 테스트 — Python, SVG, HTML 코드를 생성하여 모델의 출력 품질을 검증함.
- 양자화 품질 확인 — Q3 양자화 모델이 생성한 코드의 유효성을 직접 확인하고자 함.
- 벤치마크 신뢰도 — SVG 벤치마크가 과적합되었다는 의견과 함께 모델 성능에 대한 논의가 이루어짐.
3x3090에서 로컬로 구동 중인 Mistral Medium Q3의 실제 속도임.
먼저 Python 코드
그다음 SVG

