하드웨어를 효율적으로 사용하지 못하는 것 같은 느낌이 듭니다
I feel like I'm not using my hardware efficiently
핵심 요약
RTX 4090과 3090Ti를 보유한 사용자가 현재 모델 성능과 하드웨어 활용에 대해 고민하며 조언을 구하는 글입니다.
- 하드웨어 사양 — 7950x, 128GB DDR5, RTX 4090 및 3090Ti 구성임
- 현재 모델 — Qwen 3.6 27B Q8 모델을 llama.cpp로 구동 중임
- 기술적 고민 — 더 큰 파라미터 모델 구동 시도와 VRAM/RAM 활용 최적화에 어려움을 겪음
- 사용 목적 — 코딩보다는 연구 및 기억 보조용으로 모델을 활용함
안녕하세요,
7950x, 128GB DDR5, RTX 4090, RTX 3090TI를 사용 중입니다.
현재 llama.cpp로 Qwen3.6 27B Q8 모델을 262k 컨텍스트로 돌리고 있습니다. DDR5 RAM은 전혀 사용하지 않는데, 동시에 122B A10B 같은 모델은 구동할 수가 없네요.
제 FOMO(뒤처지는 것에 대한 불안감)가 정당한 건가요, 아니면 현재 구동할 수 있는 모델 중에 이것보다 더 나은 게 없는 건가요?


