6x MI50 (96GB) vs 6x P40 (144GB) 환경에서 MiniMax M2.7 REAP 139B Q3_K_L 구동 테스트
6x MI50's (96gb) vs 6 P40's (144gb) running MiniMax M2.7 REAP 139B Q3_K_L
핵심 요약
AMD MI50과 NVIDIA P40 서버의 LLM 구동 성능을 비교한 결과, 소프트웨어 최적화 차이로 P40이 더 우수한 성능을 보였습니다.
- 성능 비교 — 6x MI50과 6x P40 환경에서 139B 모델 구동 속도 측정함
- 소프트웨어 격차 — CUDA의 최적화 수준이 ROCm보다 높아 P40이 더 빠른 성능을 보임
- 하드웨어 잠재력 — MI50은 고사양임에도 소프트웨어 지원 부족으로 제 성능을 못 내는 상황임
- 커뮤니티 반응 — P40은 가성비 좋은 저예산 AI 서버용 카드로 여전히 높게 평가됨
안녕 얘들아,
약속한 대로 6x MI50에서 MiniMax M2.7 REAP 139B Q3_K_L을 llama-bench로 돌린 결과 가져왔다.
메모리 로드:
하드웨어:
Asus X99-E-WS (Modded BIOS GPU 여러 개 꽂으려고 개조함)
Intel(R) Xeon(R) CPU E5-2680 v4 @ 2.40GHz
128GB DDR4 RAM
SSD
6x MI50 96GB VRAM (Gen3 x8,x8,x8,x8,x8,x8)
결과
| GPU Setup | Model | Test | Result |
|---|---|---|---|
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp512 | 139.27 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | tg128 | 24.87 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp512+tg128 | 71.12 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp4096+tg128 | 120.95 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp16384+tg128 | 117.69 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp32768+tg128 | 103.56 t/s |
| 6x MI50 / Pro VII 16GB | MiniMax M2.7 REAP 139B Q3_K_L | pp65536+tg128 |


