우리 진짜 다 해낼 수 있는 거 맞지? 3090 2장 구성.
we really all are going to make it, aren't we? 2x3090 setup.
핵심 요약
3090 2장으로 로컬 AI 환경을 구축해 클라우드급 성능을 체감하며 로컬 AI의 미래를 낙관하는 글.
- 로컬 AI 성능 — 3090 2장으로 클라우드급 코딩 성능 구현.
- OS 최적화 — WSL2보다 리눅스 네이티브 환경에서 압도적인 속도 기록.
- 모델 발전 — Qwen 3.6 27B 모델로 로컬에서도 실무 수준 코딩 가능.
- 향후 전망 — 1년 내 도메인 특화 모델의 로컬 구동 가능성 기대.
진짜 소름 돋는다. 며칠 전에 누가 'club-3090' 관련 글 올린 걸 봤는데, Sonnet으로 SSE 세션 드롭 버그랑 툴 콜링 버그를 패치하고 나니까, 나 같은 '가성비' 세팅도 로컬 AI를 제대로 쓸 수 있는 길이 열린 것 같아.
참고 깃허브: https://github.com/noonghunna/club-3090 (내 거 아님)
처음엔 WSL2로 돌렸는데, LM Studio보다는 낫지만 영 별로였음. t/s는 30 정도고 pp는 400 정도... 그냥 싹 다 밀고 같은 머신에 우분투 듀얼 부팅으로 깔았는데, 와... pp/s는 4000 나오고 tk/s는 113 나옴. NVLink도 없는데 말이지. NVLink 있으면 더 빠르다던데...
어쨌든, 로컬 AI의 미래가 너무 기대됨. 48GB VRAM에서 262k 컨텍스트로 돌리는 Qwen 3.6 27B는 거의 Sonnet급 느낌이고, 클라우드보다 훨씬 빠름. 게다가 쓸만하기까지 함! 몽키 패치 몇 개 시켜봤는데 기가 막히게 잘 짜고, 코드 리뷰도 꽤 유용함. 지금은 리눅스 컴퓨터의 SSH 세션 관리까지 시켜보려고 작업 중임.
다음 업그레이드는 뭘로 할지 고민 중. M5 Ultra 512GB에 DGX Spark 4개 달까 생각도 해봤는데(프롬프트 처리 속도 때문에), 12개월 안에 작은 모델로도 프론티어급 지능(도메인 특화일 수도 있지만)에 도달할 수 있을까?
대박임!


