듀얼 DGX Spark 사용자 주목: GLM 5.3 Flash 성능 50% 이상 향상
For dual DGX spark users; GLM 5.3 flash got a 50%+ performance boost
핵심 요약
최신 레시피 적용으로 듀얼 DGX Spark 환경에서 디코드 성능이 대폭 향상되어 실사용 만족도가 매우 높음.
- 성능 향상 — 최신 레시피 적용 시 디코드 속도가 50~90% 개선됨.
- 모델 비교 — DeepSeek v4.0 Flash 대비 디코드 속도가 빠르고 지능적임.
- 실사용 후기 — 코딩, 데브옵스, 비전 작업에서 Claude Opus 4.8 수준의 성능을 보임.
- 업데이트 권장 — 반복 버그 해결 및 전반적인 작업 효율성 증대로 업그레이드 추천함.
지난 몇 달 동안 DeepSeek v4.0 flash (NVFP4)를 돌려왔음. 처음엔 0731 쓰다가 나중엔 공짜로 성능 좋아진 visionexp로 갈아탔지. 디코드 속도 65 tps 정도에 프리필은 거의 2k 찍히길래, 에이전트 4~5개 병렬로 돌려서 누적 디코드 200 tps 정도 뽑아먹으면서 썼음. 그래서 GLM 5.3으로 바꿀 생각은 전혀 없었음. 디코드랑 프리필 반토막 나는 데다 에이전트 여러 개 돌리면 확장성도 구리고, 다들 욕하던 반복 버그까지 있었거든.
그러다 며칠 전에 이 레시피 최신 버전이 떴는데, 디코드 성능이 50~90%나 떡상했다는 거임. 그래서 바로 질러봤는데, 와 진짜 감탄만 나오더라.
듀얼 DGX Sparks에서 돌아가지도 않는 최신 DeepSeek v4.1 flash보다 똑똑하고, 디코드 속도는 DeepSeek v4.0 flash보다 더 빠름. 프리필에서 아주 살짝 성능 하락이 있긴 한데, 이 정도면 충분히 감수할 만함.
| Test | visionexp-final (recorded) | glm53-low | Δ |
|---|---|---|---|
| B1 count-to-300 | 92.5 | 95.9 | +4% |
| B1 bulk SQL INSERT | 88.3 | 97.2 | +10% |
| B2 chat | 38.7 | 42.5 | +10% |
| B2 count | 92.8 | 96.0 | +3% |
| B2 code | 63.5 | 69.3 | +9% |
| B2 prose | 32.8 | 37.1 | +13% |
| B2 tool | 79.8 | 85.1 | +7% |
| B2 battery mean | 61.5 | 66.0 | +7% |
| B2 accepted tok/step | 3.26 of 6 (54%) | 3.55 of 8 (44%) | see note |
| B3 prefill @1.5K | 1738 | 1376 | -21% |
| B4 prefill @32K | 1902 |

