框架
PaddleOCR
PaddleOCR 是 Baidu 百度 出品的开源 AI 开发框架,2020 年推出,面向开发者、企业。
OCR 与文档解析工具包,把图片和 PDF 变成文字、表格和结构。
主打:文字识别、文档解析。开源,可以免费使用。使用方式:自部署、本地离线运行、命令行、API。
这是 https://godooo.ai/zh/framework/paddleocr 的 Markdown 版本。本站每个页面都有:在地址后面加 .md。
速览
能做什么
文字识别主打待校准
“100+ Languages Supported : Native recognition for a vast global library.”— github.com, 2026-09-24
文档解析主打待校准
“PaddleOCR converts PDF documents and images into structured, LLM-ready data (JSON/Markdown) with industry-leading accuracy.”— github.com, 2026-09-24
待校准由机器提出,尚待校准
平替与同类
关系
- 使用
- ERNIE 文心
常见问题
PaddleOCR 是什么?
PaddleOCR 是 Baidu 百度 出品的开源 AI 开发框架,2020 年推出,面向开发者、企业。OCR 与文档解析工具包,把图片和 PDF 变成文字、表格和结构。
PaddleOCR 免费吗?
免费。PaddleOCR 是开源软件(Apache-2.0)。
PaddleOCR 开源吗?
开源,许可证是 Apache-2.0。源代码在 https://github.com/PaddlePaddle/PaddleOCR。
PaddleOCR 能本地运行吗?
能,可以在自己的电脑上离线运行。也可以部署在自己的服务器上。
PaddleOCR 能做什么?
主打:文字识别、文档解析。
PaddleOCR 是谁开发的?
由 Baidu 百度 开发。
PaddleOCR 有哪些开源替代品?
开源的有:MinerU、Docling、Marker、Surya、MarkItDown、Unstructured、LlamaIndex、RAGFlow。其他:PDF Skill。
来源
- github.com/PaddlePaddle/PaddleOCR核实于 2026-09-24
- www.paddleocr.com