RTX 5090 보유 중, 전문적인 코딩을 위한 로컬 LLM 스택 추천 부탁드립니다.
Have a 5090, coding professionally, what stack to use for local LLMs ?
핵심 요약
RTX 5090을 활용해 API 비용을 절감하고 로컬 LLM 환경을 구축하려는 개발자의 스택 추천 요청.
- 하드웨어 성능 — RTX 5090을 활용해 로컬 LLM 구동 환경을 구축하려 함.
- IDE 도구 — VS Code 기반의 Cline이나 Continue가 로컬 모델과 궁합이 좋음.
- 모델 성능 — Qwen3 32B 모델이 파이썬 코딩에서 준수한 성능을 보여줌.
- 언어별 격차 — 파이썬은 로컬 모델로 대체 가능하나 러스트나 GLSL은 성능 격차가 존재함.
안녕하세요,
코딩은 LLM이 존재하기 전부터 제 부업 중 하나였습니다.
코딩을 아주 잘하는 편은 아니지만, 정확히 무엇이 필요한지 아는 것이 일의 절반이라 어떻게든 해내고 있습니다.
오랫동안 Cursor를 사용해 왔고, 이제 코딩 작업 시간이 훨씬 단축되어 본업에 더 집중할 수 있게 되었습니다. 현재는 주로 Opus와 Sonnet을 사용하고 있는데 API 비용이 감당하기 힘들 정도로 치솟고 있습니다. 여전히 수익은 나지만, 토큰에 들어가는 비용을 보니 로컬 시스템을 구축하는 것을 진지하게 고려하게 되네요.
저는 주로 파이썬, 러스트, GLSL을 다룹니다.
Cursor를 대체할 만한 로컬 LLM 친화적인 IDE는 무엇일까요?
Qwen3.6을 Sonnet이나 Opus 같은 모델과 비교해서 사용해 본 경험이 있으신가요?
VSCodium에서 Roo와 함께 ollama를 시도해 봤는데 결과가 좋지 않았습니다. 모델들이 툴 사용에 어려움을 겪고 전반적으로 매우 투박하게 느껴졌습니다.
테스트용으로 사용할 수 있는 5090 시스템이 있지만, 만약 프로덕션 환경에서 사용하게 된다면 전용 시스템이 필요할 것 같아 Mac Studio나 RTX 6000으로 전환할 의향도 있습니다.
답변 주셔서 감사합니다.


