4x R9700에서 Qwen3.8-Flash-Next를 돌려본 첫 며칠 - 꽤 흥미롭네요
First few days of qwen3.8-flash-next on 4x R9700 - it's been really interesting so far
핵심 요약
4개의 R9700 GPU로 Qwen3.8-Flash-Next 모델을 테스트한 결과, 속도와 품질 면에서 기대 이상의 성능을 보여주었습니다.
- 성능 테스트 — 4x R9700 환경에서 Qwen3.8-Flash-Next 모델의 에이전트 코딩 활용 사례를 테스트함
- 압도적 속도 — 단일 스트림 150+t/s, 동시 3~5개 스트림에서 각각 100t/s 수준의 생성 속도를 기록함
- 효율적 대시보드 — OpenObserve를 활용해 로그와 메트릭을 시각화하여 시스템 상태를 모니터링함
- 하드웨어 구성 — 8슬롯을 차지하는 4개 GPU 적층 구조로, 온도 문제 없이 안정적인 구동이 가능함
최근 며칠간의 상황을 보여주는 지표 대시보드야.
주로 pi harness를 써서 여러 가지 에이전트 코딩 유스케이스를 테스트해 봤어.
qwen3.8-flash-next가 내 기대를 완전히 뛰어넘었음 (사용처: https://huggingface.co/tcclaviger/Qwen3.8-Flash-Next-MXFP4-FP8)
속도랑 퀄리티 둘 다 진짜 놀라운 수준이야. 동시 스트림 3~5개 돌려도 각각 100t/s 정도 나오고, 단일 스트림은 그냥 150+t/s까지 가볍게 찍어버리네. Prefill은 10k+t/s 나옴.

