RTX 3090 듀얼 빌드
Dual rtx 3090 build
핵심 요약
로컬 LLM 추론을 위해 RTX 3090 두 개를 장착한 PC 빌드 공유 및 활용 도구 스택에 대한 조언 구함.
- 하드웨어 구성 — RTX 3090 2개와 1600W 파워를 사용한 로컬 LLM 추론용 빌드.
- 소프트웨어 스택 — Qwen 3.6 27B 모델과 Nginx를 활용한 에이전트 작업 및 RAG 파이프라인 구축.
- 발열 관리 — 언더볼팅을 통해 70~80도 수준의 온도를 유지하며 안정적인 세션 운영.
- 커뮤니티 조언 — 매직 컨텍스트 및 웹 검색 활용 등 로컬 LLM 활용 최적화 팁 공유.
이 커뮤니티에 들어오면서 잊고 지냈던 소프트웨어 엔지니어링에 대한 새로운 취미와 관심이 생겼습니다.
그래서 주로 추론용으로 RTX 3090 듀얼 빌드를 만들었습니다. 당장 ChatGPT를 대체할 수는 없겠지만, 업무 환경에서 유용하게 쓰려면 어떤 도구 스택이 좋을까요? MCP 서버나 커스텀 도구/스크립트가 필수인가요?
현재 VScode 프리뷰와 Qwen 3.6 27B, Nginx 서버를 사용 중입니다. 주로 유용한 컨텍스트를 활용한 에이전트 작업이나 코드 베이스에 대한 더 나은 이해(RAG 파이프라인?)에 관심이 많습니다.
이미 이 커뮤니티에서 많은 도움을 받았습니다. 클라우드 비용이 소비자 수준에서 감당하기 어려워질까 봐 걱정되는데, 로컬 LLM이 계속 성장했으면 좋겠네요.


