Boogu Base, Turbo, Edit - 오픈소스 통합 이미지 생성 및 편집 모델 시리즈
Boogu Base, Turbo, Edit - open-source unified image generation and editing model series
핵심 요약
고품질 이미지 생성, 편집, 텍스트 렌더링을 지원하는 Apache-2.0 오픈소스 모델 시리즈 Boogu-Image-0.1이 공개되었습니다.
- 통합 모델 시리즈 — Base, Turbo, Edit 등 다양한 변형 모델로 구성됨
- 강력한 텍스트 렌더링 — 포스터나 문서 등 복잡한 레이아웃에서 뛰어난 성능을 보임
- 효율적인 생성 — Turbo 모델은 3~4단계만으로 고품질 사진 생성이 가능함
- 오픈소스 기여 — 제한된 컴퓨팅 자원으로도 데이터 품질 개선을 통해 성능을 극대화함
Boogu-Image-0.1은 Apache-2.0 오픈소스 통합 이미지 생성 및 편집 모델 제품군이야. Base, Turbo, Edit 같은 다양한 버전이 있고, 고품질 텍스트-이미지 생성, 빠른 생성 속도, 이미지 편집, 그리고 한영 텍스트 렌더링까지 아주 실용적이고 안정적인 성능을 보여주지. Nano Banana Pro나 GPT-Image-2 같은 폐쇄형 멀티모달 시스템들이 쩌는 성능을 내는 건 단순히 모델 하나가 잘나서가 아니라, 시스템 전체가 아주 유기적으로 돌아가기 때문이거든. 근데 우리는 폐쇄형 시스템에 비해 턱없이 부족한 컴퓨팅 자원으로도 모델의 이해도, 데이터 품질, 학습 파이프라인을 체계적으로 개선하면 이미지 생성 및 편집 성능을 확실하게 끌어올릴 수 있다는 걸 증명했어. 실제로 기존 오픈소스 모델들이랑 비교하면 학습 데이터 규모가 10분의 1 수준인데도 이 정도 성능을 뽑아낸 거지. 이번 연구랑 오픈소스 공개가 멀티모달 생성 및 이해 분야의 오픈소스 생태계를 발전시키는 데 도움이 됐으면 좋겠다.
-
📸 텍스트 렌더링까지 확실한 사진 생성 — Boogu-Image-0.1-Turbo는 실사 같은 사진을 뽑아주면서, 간단한 문구부터 빽빽한 텍스트까지 아주 깔끔하게 렌더링해.
-
📝 강력한 밀집 텍스트 렌더링 — Boogu-Image-0.1-Base는 포스터, 문서, 브랜드 가이드, 복잡한 이중 언어 디자인처럼 텍스트가 엄청나게 들어가는 작업에서 아주 경쟁력 있는 결과물을 보여줘.
-
💡 추천 — 텍스트가 엄청나게 많이 들어가는 작업을 주로 한다면, 레이아웃이랑 글자 정확도를 위해 Boogu-Image-0.1-Base를 2K 해상도로 돌리는 걸 추천해.
-
Boogu-Image-0.1-Base: 다양성과 제어력이 뛰어난 파운데이션 모델이야. 파인튜닝이나 후속 개발용으로 딱이지. 주로 초밀집 텍스트 렌더링을 노리고 만든 거라, 실사 느낌을 원하면 Turbo를 쓰는 게 정신 건강에 좋을 거야.
-
Boogu-Image-0.1-Edit: 이미지 편집이랑 변환 전용 모델이야.
-
Boogu-Image-0.1-Turbo: 파라미터 수는 똑같은데 증류(Distilled) 과정을 거쳐서 3~4 스텝이면 생성이 끝나. 한영 텍스트 렌더링이랑 프롬프트 준수 능력은 그대로 유지하면서, 고품질 생성과 실사 느낌에 올인한 모델이지.
모델 크기 : 10B (설정에 따라 12-80GB VRAM 필요, 자세한 건 모델 카드 확인)
모델 링크:


