LLM 내장 로컬 만화 번역기, Rust 및 llama.cpp 통합 구현
Local manga translator with LLM build-in, written in Rust with llama.cpp integration
핵심 요약
Rust와 llama.cpp를 활용해 NVIDIA/AMD GPU를 지원하는 오픈소스 로컬 만화 번역 도구 Koharu 공개.
- 기술 스택 — Rust와 llama.cpp를 통합하여 Gemma 및 Qwen 모델의 로컬 추론을 지원함.
- 핵심 기능 — OCR, 레이아웃 분석, 인페인팅을 결합하여 이미지 내 텍스트를 자동 번역함.
- 편집 도구 — 번역된 텍스트의 폰트, 크기, 색상을 수정할 수 있는 자체 에디터를 내장함.
- 확장성 — OpenAI 호환 API 연동이 가능하며 향후 브라우저 확장 프로그램 통합을 계획 중임.
안녕하세요 LocalLLaMA 여러분,
몇 주 전에 포스트를 올렸었는데, 이번에는 프로젝트가 훨씬 더 안정적이고 사용하기 쉬워졌습니다.
이것은 어떤 이미지든 번역할 수 있는 만화 번역기입니다. 객체 탐지, 시각적 LLM 기반 OCR, 레이아웃 분석, 그리고 미세 조정된 인페인팅 모델의 조합을 사용합니다. 만화 번역을 위한 가장 성능이 뛰어나고 사용하기 쉬운 파이프라인이라고 믿습니다.
LLM 부분의 경우, 이 애플리케이션에 llama.cpp를 통합했습니다. Gemma 4 제품군과 Qwen3.5 제품군을 지원하며, 검열 해제된 모델 및 미세 조정된 모델도 포함되어 있습니다. 또한 OpenAPI 호환 API를 지원하므로 LM Studio나 OpenRouter 등을 사용할 수 있습니다.
데모 비디오가 워크플로우를 잘 설명해준다고 생각합니다. 기본적으로 버튼 하나만 클릭하면 파이프라인이 실행됩니다. 결과물을 교정하고 편집할 수도 있으며, 폰트, 크기, 색상 등을 변경할 수 있습니다. 미니 포토샵 에디터 같은 기능이죠.
관심 있는 분들을 위해 말씀드리자면, 이 프로젝트는 완전 오픈소스입니다: https://github.com/mayocream/koharu



