百度公开了一个能一次性完整读取100页PDF的OCR工具,而且能在本地电脑上运行。
项目叫Unlimited-OCR。
链接:github.com/baidu/Unlimited-OCR
只有30亿参数,轻量级,不用分页,一次读完
多语言原生支持,标准测试里精度超过了DeepSeek-OCR
云端OCR处理1000页要1.5到15美元,这个免费,完全本地跑
支持Transformers、vLLM、Ollama、llama.cpp,部署起来不麻烦
以前只能付费传到云端处理的文档,现在本地就能免费搞定。
长合同、论文这类东西,一次读完就行。