로컬 모델을 활용한 NPC 엔진
NPC Engine Using Local Models
핵심 요약
SillyTavern 아키텍처 기반의 게임 NPC 엔진을 개발하여 로컬 모델로 몰입감 넘치는 RPG 구현을 시도함.
- NPC 엔진 개발 — SillyTavern 스타일의 아키텍처를 활용한 게임 독립적 NPC 엔진 구축함.
- 기술 스택 구성 — NVIDIA Parakeet, Gemma 4 26B, Qwen3-TTS를 조합해 빠른 응답 속도 확보함.
- RAG 활용 — NPC 행동 목록을 상황에 맞게 동적으로 주입하여 프롬프트 효율을 최적화함.
- 하드웨어 요구사항 — 고성능 모델 구동을 위해 5090급 GPU 환경을 활용함.
SillyTavern 스타일의 아키텍처를 기반으로 게임 독립적인 NPC 엔진/백엔드를 개발 중인데, 로컬 모델들의 성능이 점점 좋아지고 있어서 이런 방식이 RPG의 미래가 될 수 있다고 진심으로 생각함.
현재 STT(음성 인식)에는 NVIDIA Parakeet 0.6, LLM에는 Gemma 4 26B A4B, 음성 합성에는 Qwen3-TTS를 사용 중인데, 꽤 괜찮은 품질로 아주 빠른 응답 속도를 얻고 있음.
이 엔진이 잘 작동하는 핵심은 RAG를 사용해 프롬프트를 간결하게 유지하는 것임. 예를 들어, NPC가 게임 내에서 할 수 있는 수백 가지의 행동이 있지만, 플레이어의 메시지나 맥락에 따라 실제로 의미 있는 행동들만 선택적으로 주입함. 그래서 매 턴마다 모델에 방대한 목록을 다 집어넣어 과부하를 주지 않음.



