샤오미 12 Pro 기반 24/7 AI 서버: Llama.cpp와 LiteRT 성능 비교 (V2 리디자인)
Llama.cpp VS LiteRT on a custom Xiaomi 12 Pro 24/7 Server (V2 Redesign)
핵심 요약
샤오미 12 Pro를 개조해 24/7 AI 서버로 구축하고 Llama.cpp와 LiteRT의 성능을 비교함.
- 냉각 시스템 — 구리 방열판과 듀얼 팬을 장착해 40도에서 작동하는 능동형 냉각 구조를 구현함.
- 전원 공급 장치 — 배터리 BMS에 직접 연결하고 퓨즈와 과전압 보호 회로를 추가해 안전한 전원부를 구성함.
- 성능 비교 — Llama.cpp는 CPU 부하가 적고 안정적이며, LiteRT는 속도는 빠르지만 CPU 점유율이 높음.
- DIY 프로젝트 — 남는 고성능 스마트폰을 활용한 서버 구축은 재미있지만, 실용성을 원하면 미니 PC가 나음.
이전 게시물(24/7 Headless AI Server on Xiaomi 12 Pro (Snapdragon 8 Gen 1 + Ollama/Gemma4)에서 주신 조언들 정말 감사합니다. 덕분에 영감을 얻어 냉각과 전원 공급 장치를 완전히 새로 설계했습니다.
변경 사항:
- 냉각: 뒷면에 팬이 달린 구리 방열판을 설치했습니다. 앞면은 화면을 제거하고 서멀 패드를 사용해 알루미늄 판에 팬 2개와 함께 장착했습니다. 이제 온도가 40°C가 되면 냉각이 켜지고 35°C가 되면 꺼집니다.
- 전원 공급 장치: 안전한 맞춤형 PSU를 직접 제작했습니다. 배터리를 분해하고 커패시터를 통해 PSU를 배터리의 BMS에 직접 연결했습니다. 입력/출력 퓨즈 2개, 스마트폰 보호를 위한 4.3V 크로우바 회로, PSU용 백업 팬을 추가했습니다(일주일 테스트 결과, 발열이 심하지 않아 거의 필요 없었습니다).
- 하우징: 3D 프린팅으로 맞춤형 케이스를 만들고, 알루미늄 프로파일로 스탠드를 제작했으며, 외부 전원 버튼을 연결했습니다.
현재 모습은 다음과 같습니다:

