标着「一次读完一整本书」,Unlimited-OCR 仓库里却只放着 329 行 Python
14688 Star 的 Baidu Unlimited-OCR,仓库里只有 329 行代码,真正的硬核藏在 logit processor 和 SGLang wheel 里。 14688 Star 的 Baidu Unlimited-OCR,仓库里只有 329 行代码,真正的硬核藏在 logit processor 和 SGLang wheel 里。
共 4 篇文章
围绕 #OCR 汇总相关文章,适合连续阅读同一主题下的实践与思考。
14688 Star 的 Baidu Unlimited-OCR,仓库里只有 329 行代码,真正的硬核藏在 logit processor 和 SGLang wheel 里。 14688 Star 的 Baidu Unlimited-OCR,仓库里只有 329 行代码,真正的硬核藏在 logit processor 和 SGLang wheel 里。
发布于 2026年07月20日 12:54
75k Star 开源 OCR 引擎 Tesseract,历经 HP、Google、社区三时代,从特征工程走到 LSTM。 75k Star 开源 OCR 引擎 Tesseract,历经 HP、Google、社区三时代,从特征工程走到 LSTM。
发布于 2026年07月03日 16:20
AI2 的 olmOCR 把 PDF 转纯文本,每百万页 200 美元。拆开 5 段流水线,看渲染、视觉模型、后处理、评测各藏了什么反直觉决策。 AI2 的 olmOCR 把 PDF 转纯文本,每百万页 200 美元。拆开 5 段流水线,看渲染、视觉模型、后处理、评测各藏了什么反直觉决策。
发布于 2026年07月02日 01:41
MinerU 用 VLM 加 OCR 双引擎把 PDF、Office 文档解析成结构化 Markdown 和 JSON,7.1 万 Star 背后是给 RAG 和 Agent 喂数据的基础设施。 MinerU 用 VLM 加 OCR 双引擎把 PDF、Office 文档解析成结构化 Markdown 和 JSON,7.1 万 Star 背后是给 RAG 和 Agent 喂数据的基础设施。
发布于 2026年06月28日 21:07
快捷键:`Cmd/Ctrl + K` 打开,`Esc` 关闭。支持语义搜索——直接描述你想找的内容即可。
输入关键词开始搜索。
扫描二维码关注微信公众号