GPU와 Jetson Orin에서 구동되는 Gemma 4 12B와 E2B의 음성 대화
Voice conversations between Gemma4 12B and E2B on GPU and Jetson Orin
핵심 요약
GPU와 Jetson Orin에서 구동되는 Gemma 4 모델들이 음성 대화와 립싱크를 구현한 오픈소스 프로젝트.
- 하드웨어 구성 — RTX PRO 4500과 Jetson Orin NX에서 각각 Gemma 4 12B와 E2B 모델 구동함.
- 음성 엔진 — CUDA 장치용 C 언어 기반의 Cortexist Little Gemma 엔진 사용함.
- 기능 구현 — 립싱크, 표정, 제스처를 포함한 실시간 음성 대화 파이프라인 지원함.
- 오픈소스 공개 — 전체 프로젝트 소스 코드가 깃허브에 공개됨.

Gemma 4 12B는 RTX PRO 4500 Blackwell에서 돌아간다. Gemma 4 E2B는 Jetson Orin NX 16GB에서 돌아가는데, Jetson Orin Nano Super 8GB에서도 비슷한 성능이 나올 거다. 두 시스템 다 reSpeaker Flex 4-mic 어레이랑 3W 스피커를 쓴다. 추론은 CUDA 장치용으로 C로 짠 소형 LLM 엔진인 Cortexist Little Gemma가 담당한다. Jetson Orin에서는 llama.cpp보다 빠르고, 긴 음성 프롬프트를 입력해도 성능 저하가 없다. 파이프라인은 립싱크, 표정, 제스처까지 다 지원한다. 전부 오픈소스임.
사람이랑 대화도 가능함.

