
MonkeyOCR
Yuliang-Liu
A lightweight LMM-based Document Parsing Model
AI 简介
MonkeyOCR 是一个基于轻量级多模态大模型(LMM)的文档解析系统,专注于从扫描件、PDF等复杂版式文档中准确提取结构化信息。其核心采用“结构-识别-关系”三元组范式,支持文本、表格、标题、段落等元素的联合检测与语义建模,具备端到端处理能力,无需依赖传统OCR后处理流水线。模型已在Hugging Face和ModelScope开源,适配中英文混合、低质量图像及多栏排版等真实办公场景,适用于智能文档处理、合同分析、票据识别等企业级自动化需求。
Python
Apache License 2.06.6k
Stars
458
Forks
48
Watchers
1
Issues
Star 增长
今日0
近 7 天0
近 30 天+2
综合评分64.19
默认分支main