R9V 업데이트: R9700 2개와 128GB RAM 환경에서 Qwen3.8 Flash Next IQ4_XS 모델로 초당 약 100토큰 달성. n-gram SSD 스트리밍 충돌 수정, 진단 기능 개선 및 이미지 고정 기능 추가. Q4_K_XL 지원 시작, 초당 50토큰 기록.
R9V Update: now ~100 tok/s in TG on Qwen3.8 Flash Next IQ4_XS on x2 R9700 + 128GB RAM. Fixed crashes with n-gram SSD streaming, improved diagnostics, plus pinned images. Q4_K_XL now supported, 50 tok/s TG.
핵심 요약
R9V 업데이트를 통해 RDNA4 환경에서의 추론 성능을 개선하고 충돌 문제를 해결했습니다.
- 성능 최적화 — R9700 듀얼 구성에서 초당 100토큰의 추론 속도 달성함
- 안정성 개선 — n-gram SSD 스트리밍 충돌 수정 및 진단 기능 강화됨
- 모델 지원 확대 — Q4_K_XL 양자화 모델 지원 및 관련 성능 확보함
- 커뮤니티 협업 — Launch80 디스코드에서 RDNA4 최적화 관련 정보 공유 중임
github.com
원문 사이트로 이동
이번 업데이트 올렸으니까 이제 튕기는 일 좀 줄었으면 좋겠네. 수정하고 나서 12시간 동안 빡세게 테스트 돌려봤는데 딱히 불안정한 건 안 보였음. Q4 K XL은 좀 더 다듬어야 해서 나중에 시간 날 때 작업할 예정. 지금 이거랑 제대로 된 추론 엔진, 그리고 6개월 동안 매달린 딥 리서치/사이트 빌더 앱까지 동시에 굴리느라 정신이 하나도 없다. 이것들 다 배포하고 나면 다시 여기 집중할게. 다들 고맙다!
광고 하나 하자면, RDNA4 최적화에 관심 있으면 Launch80 디스코드 들어와 봐! 거기 형들이 나보다 더 쩌는 수치랑 설정값들 계속 뽑아내고 있음. 모델이 VRAM에 완전히 안 올라가는 이런 설정들에서 이제 슬슬 한계치에 가까워지고 있는 것 같다.

