ModelScope에 Unlimited-OCR 출시! 3.3B 다국어 OCR 모델로 이미지, 다중 페이지 문서, PDF를 한 번에 파싱 가능. 라이선스: MIT
Unlimited-OCR is now on ModelScope! A 3.3B multilingual OCR model for one-shot parsing across single images, multi-page documents, and PDFs. License: MIT
핵심 요약
3.3B 파라미터의 다국어 OCR 모델 Unlimited-OCR이 공개되어 긴 문서 파싱과 다양한 레이아웃 처리를 지원합니다.
- 문서 파싱 — 크롭 영역 방식이 아닌 전체 문서 파싱 지원
- 긴 시퀀스 — 32K 출력 길이로 긴 OCR 작업 처리 가능
- 이미지 모드 — 문서 레이아웃에 따른 Base 및 Gundam 모드 제공
- 서빙 지원 — Transformers 및 SGLang을 통한 OpenAI 호환 스트리밍 지원
전체 문서 파싱 (크롭 영역 OCR 대신)
32K 출력 길이 (긴 OCR 시퀀스용)
문서 레이아웃에 따른 Base 및 Gundam 이미지 모드
Transformers 추론 + OpenAI 호환 스트리밍 요청을 지원하는 SGLang 서빙
DeepSeek-OCR 스타일의 문서 파싱을 한 단계 더 발전시키기 위해 제작됨.



