百度开源 Unlimited-OCR:一键搞定任意长度文档的高精度 OCR 模型

今天在 GitHub Trending 上看到一个有意思的项目:Unlimited-OCR,这是百度开源的一个通用文档 OCR 模型,能够对任意长度、任意版面的文档图片或 PDF 进行端...

技术 · 开源 · 周三, 七月 22, 2026 · 5 分钟 · 2067 字

olmOCR:基于视觉语言模型的开源 PDF 文档 OCR 工具包

开篇引导段: 今天在 GitHub Trending 上看到一个有意思的项目:olmOCR,这是由艾伦人工智能研究所(AI2)开发的开源 OCR 工具包,能够利用 7B 参数的视觉语言模...

技术 · 开源 · 周三, 七月 1, 2026 · 7 分钟 · 3047 字

MinerU:高精度文档解析引擎,一键转换 PDF/DOCX/PPTX/XLSX 为 Markdown

今天在 GitHub Trending 上看到一个有意思的项目:MinerU,一个高精度文档解析引擎,能将 PDF、DOCX、PPTX、XLSX 和图片等格式一键转换为结构化...

技术 · 开源 · AI工具 · 周五, 六月 26, 2026 · 6 分钟 · 2658 字

PaddleOCR:领先的开源OCR与文档AI工具包深度解析

今天在 GitHub Trending 上看到一个有意思的项目:PaddleOCR,这是百度飞桨团队推出的全球领先的OCR工具包和文档AI引擎,能够将PDF文档和图像转换...

技术 · 开源 · 周四, 六月 4, 2026 · 6 分钟 · 2780 字