Qwen3.6 35b Q2_XXS: 2026년에 GPU가 부족해도 괜찮은 이유
Qwen3.6 35b Q2_XXS: Being GPU poor in 2026 is not so bad
핵심 요약
저사양 노트북에서 Qwen3.6 35B 모델을 활용해 24분 만에 간단한 RPG 게임을 구현한 사례입니다.
- 저사양 구동 — 8GB RAM 노트북에서 Qwen3.6 35B 모델을 CPU로 실행함
- 게임 개발 — 프롬프트 하나로 젤다 스타일의 2D RPG 게임을 HTML 파일로 생성함
- 성능 최적화 — IQ2_XXS 양자화 모델을 사용하여 초당 3토큰의 속도로 구동함
- 접근성 확대 — 고사양 GPU 없이도 로컬에서 LLM을 활용한 개발이 가능함을 입증함
감자 같은 똥컴으로 24분 만에 개쩌는 RPG 만드는 법
노트북 사양: I3, 8gb RAM, 0gb VRAM, Windows 11
llama-server.exe --host [0.0.0.0](http://0.0.0.0) --port 8080 -m models\\qwen3.6-35b-Instruct\\Qwen\_Qwen3.6-35B-A3B-IQ2\_XXS.gguf -c 8192 -n 8192 -tb 4 -b 512 -ub 512 --cache-type-v q8\_0 --cache-type-k q8\_0 -fa auto -ngl 0 --temp 0.0 --reasoning off
(추론 토큰 너무 많이 나오는 거 꼴보기 싫어서 Instruct 모델 썼음)
결과: 24분 소요, 3 t/s
프롬프트:
Create a simple RPG Zelda-like 2d world
character attacking the enemies
KEYS:
W up
S down
A left
D right
F attack
A guy with a sword kills enemies.
Earn points, level up, and gain strength.
Infinite loop of enemies randomly appearing.
Output: Single HTML File



