
PaddleOCR 3.5 安装完全指南Python 分发包、可选依赖组、推理引擎与训练导出环境搭建【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR本指南以 docs/version3.x/installation.md 为骨架结合仓库内 pyproject.toml、requirements.txt 等源码与配置展开帮助你在本地完成 PaddleOCR 推理环境的搭建既能通过paddleocrPython 分发包按需启用文档解析、信息抽取、文档翻译等能力也能独立安装训练与模型导出所需的完整依赖并在此基础上理解推理引擎与飞桨框架的安装前提。PaddleOCR 3.x 提供两条彼此独立的安装路径一是面向本地推理的paddleocrPython 分发包含可选依赖组安装后即可调用预训练产线完成 OCR、版面解析、表格识别、关键信息抽取等推理任务二是面向模型训练与导出的完整仓库依赖需要先安装飞桨框架再安装仓库根目录的 requirements.txt。本文按此两条主线组织并补充推理引擎选择、依赖组映射等底层细节帮助你按需安装、避免依赖冲突。1. 安装paddleocrPython 库两条路径1.1 Python 版本要求paddleocr本体与doc2md依赖组支持Python 3.8 及以上其他可选依赖组doc-parser、ie、trans、all等受上游依赖限制需要Python 3.9 及以上。这与仓库 pyproject.toml 中声明的requires-python 3.8以及lmdb; python_version 3.9等条件依赖相互印证基础包在 3.8 即可运行但更重的可选能力对解释器版本有更高要求。1.2 从 PyPI 安装最新版本# 仅需要通用 OCR 与文档图像预处理等默认能力 python -m pip install paddleocr # 需要文档解析、文档理解、文档翻译、关键信息抽取等全部可选能力 # python -m pip install paddleocr[all]执行后pip会同时解析并安装 pyproject.toml 中声明的核心依赖paddlex[ocr-core]3.7.0,3.8.0、PyYAML6、requests、aiohttp3.8.0、typing-extensions4.12。也就是说安装paddleocr时 PaddleX 会作为底层推理基础设施一并安装但只安装 OCR 类任务所需的最小依赖子集避免依赖体积过度膨胀详见 PaddleOCR 与 PaddleX。1.3 从源码安装# 仅需要通用 OCR 与文档图像预处理等默认能力 python -m pip install paddleocrgithttps://github.com/PaddlePaddle/PaddleOCR.git # 需要文档解析、文档理解、文档翻译、关键信息抽取等全部可选能力 # python -m pip install paddleocr[all]githttps://github.com/PaddlePaddle/PaddleOCR.git从源码安装默认跟踪仓库当前默认分支。仓库使用setuptools_scm动态生成版本号见 pyproject.toml 的[tool.setuptools_scm]配置因此安装的是与当前提交对应的开发版本。2. 按功能选择依赖组extras除all外可通过指定依赖组启用部分可选能力。依赖组表示能力域文档解析、信息抽取、文档翻译等。各依赖组如下| 依赖组名称 | 对应的功能 | | - | - | |doc-parser| 文档解析可用于提取文档中的表格、公式、印章、图片等版面元素包含 PP-StructureV3 等模型方案 | |ie| 信息抽取可用于从文档中提取关键信息如姓名、日期、地址、金额等包含 PP-ChatOCRv4 等模型方案 | |trans| 文档翻译可用于将文档从一种语言翻译为另一种语言包含 PP-DocTranslation 等模型方案 | |doc2md| 文档转 MarkDown可用于将 Word、Excel、PowerPoint 文件快速转为可读文本 | |all| 完整功能 |通用 OCR 产线与文档图像预处理产线无需额外依赖组文档解析、信息抽取、文档翻译等按上表安装对应组。各产线所属依赖组见对应产线文档单功能模块在任一包含该模块的依赖组安装后即可调用其基础能力。2.1 依赖组在仓库中的真实映射依赖组的实际内容定义在 pyproject.toml 的[project.optional-dependencies]段[project.optional-dependencies] doc-parser [paddlex[ocr,genai-client]3.7.0,3.8.0] ie [paddlex[ie]3.7.0,3.8.0] trans [paddlex[trans]3.7.0,3.8.0] doc2md [python-docx0.8.11, python-pptx0.6.21, openpyxl3.0.0, pylatexenc2.10,3] all [paddlex[ocr,genai-client,ie,trans]3.7.0,3.8.0, python-docx0.8.11, python-pptx0.6.21, openpyxl3.0.0]由此可以确认几个关键事实doc-parser与ie、trans本质是 PaddleX 的 extras 透传doc-parser对应paddlex[ocr,genai-client]ie对应paddlex[ie]trans对应paddlex[trans]doc2md是纯办公文档转换依赖python-docxWord、python-pptxPowerPoint、openpyxlExcel分别对应 Word、PPT、Excel 三种格式的解析转换pylatexenc用于 LaTeX 公式编码处理对应的转换实现位于 paddleocr/_doc2md其convert(source, outputNone, **kwargs)函数支持将办公文档转为 Markdown可用paddleocr.doc2md_convert调用all是前四者的并集且不含pylatexenc其被限定3属于doc2md的专属依赖。安装示例# 文档解析能力版面、表格、公式、印章等 python -m pip install paddleocr[doc-parser] # 关键信息抽取能力PP-ChatOCRv4 等 python -m pip install paddleocr[ie] # 文档翻译能力PP-DocTranslation 等 python -m pip install paddleocr[trans] # 办公文档转 Markdown python -m pip install paddleocr[doc2md]2.2 安装后的功能入口安装完成后paddleocr包对外暴露完整的能力面见 paddleocr/init.py 的__all__单功能模型TextDetection、TextRecognition、FormulaRecognition、LayoutDetection、SealTextDetection、TableStructureRecognition、DocVLM等产线PipelinePaddleOCR通用 OCR、PPStructureV3文档解析、PPChatOCRv4Doc关键信息抽取、PPDocTranslation文档翻译、DocPreprocessor文档图像预处理等命令行入口paddleocr命令由 pyproject.toml 的[project.scripts]注册paddleocr paddleocr.__main__:console_entry可通过paddleocr --help查看可用子命令。3. 安装推理引擎按需PaddleOCR 3.5 采用统一推理引擎配置底层可对接飞桨、Transformers 等。若要实际执行模型推理请参考 推理引擎与配置说明 安装所选推理引擎。当前支持的推理引擎及安装方式如下| 引擎类别 |engine取值 | 安装方式 | | - | - | - | | 飞桨框架 |paddle、paddle_static、paddle_dynamic| 参考 飞桨框架安装 | | Transformers |transformers|python -m pip install transformers5.10.0| | ONNX Runtime |onnxruntime|python -m pip install onnxruntime-gpu|要点说明默认引擎行为如果不显式指定engine除高性能推理与生成式 AI 客户端请求等少数场景外大多数情况下会优先使用飞桨框架推理显式指定engine后则优先按指定引擎初始化依赖隔离建议不同推理引擎之间可能存在依赖冲突建议每个环境仅安装一种推理引擎引擎用法示例摘自 inference_engine.md# CLI 指定引擎 paddleocr text_detection -i general_ocr_001.png --engine transformers paddleocr ocr -i general_ocr_001.png --engine paddle_static# Python API 指定引擎与引擎配置 from paddleocr import TextDetection model TextDetection( model_namePP-OCRv5_server_det, enginepaddle_static, engine_config{ device_type: cpu, cpu_threads: 4, run_mode: mkldnn, }, ) result model.predict(general_ocr_001.png)3.1 飞桨框架安装要点飞桨框架的安装细节参见 飞桨框架安装关键信息如下pip 安装CPUpython -m pip install paddlepaddle3.2.0 -i https://www.paddlepaddle.org.cn/packages/stable/cpu/pip 安装GPU需显卡驱动版本满足要求例如python -m pip install paddlepaddle-gpu3.2.0 -i https://www.paddlepaddle.org.cn/packages/stable/cu118/无需关注物理机上的 CUDA 版本只需关注显卡驱动程序版本Docker 安装使用飞桨官方镜像并映射工作目录GPU 场景加--gpus all参数例如docker run --gpus all --name paddleocr -v $PWD:/paddle --shm-size8G --networkhost -it ccr-2vdh3abv-pub.cnc.bj.baidubce.com/paddlepaddle/paddle:3.0.0-gpu-cuda11.8-cudnn8.9-trt8.6 /bin/bash验证安装python -c import paddle; print(paddle.__version__)成功时输出版本号如3.2.0版本对应关系PaddleOCR 与 PaddleX、飞桨存在版本对应表见 PaddleOCR 与 PaddleX例如 PaddleOCR3.5.x对应 PaddleX3.5.0,3.6.0、飞桨3.0.0安装时注意三者版本匹配。4. 安装训练与导出依赖4.1 与推理安装路径的关系训练与导出路径与第 1 节的paddleocr包及可选依赖组属于不同安装维度同一环境中可同时存在无需强制隔离。但训练与导出依赖飞桨框架且若环境中已安装飞桨之外的推理引擎如 Transformers可能出现依赖冲突建议在全新的环境中进行安装。Python 版本要求训练与模型导出支持 Python 3.8 及以上。4.2 克隆仓库并安装依赖# 推荐方式 git clone https://github.com/PaddlePaddle/PaddleOCR # 可选切换到指定分支 git checkout release/3.5 # 如果因为网络问题无法克隆成功也可选择使用码云上的仓库 git clone https://gitee.com/paddlepaddle/PaddleOCR # 注码云托管代码可能无法实时同步本 GitHub 项目更新存在3~5天延时请优先使用推荐方式。执行如下命令安装其余训练依赖python -m pip install -r requirements.txt4.3 训练依赖清单解读仓库根目录 requirements.txt 是训练与导出路径的完整依赖清单主要包括| 依赖 | 用途 | | - | - | |shapely、pyclipper| 多边形几何运算用于检测框的生成、裁剪与后处理 | |scikit-image| 图像处理与评价指标计算 | |lmdb| LMDB 数据集OCR 训练数据常以 LMDB 格式存储的读取Python 3.9 与 3.9 分别有版本约束 | |tqdm、numpy| 训练进度展示与数值计算基础库 | |rapidfuzz| 文本相似度计算用于识别结果评估 | |opencv-python、opencv-contrib-python| 图像读取与数据增强 | |cython| 编译加速算子如部分后处理扩展模块 | |Pillow、pyyaml、requests| 图像 I/O、配置解析、网络请求 | |albumentations、albucore| 数据增强albucore用于兼容 albumentations 新版本 | |packaging| 版本号解析与比较 |安装完成后即可使用仓库 tools/train.py、tools/export_model.py 等脚本进行模型训练与导出。5. 安装验证与常见问题5.1 快速验证安装# 验证 paddleocr 包与版本 python -c import paddleocr; print(paddleocr.__version__) # 验证飞桨框架训练/导出路径必需 python -c import paddle; print(paddle.__version__) # 查看 CLI 可用子命令 paddleocr --helppaddleocr.__version__通过importlib.metadata读取分发包元数据见 paddleocr/_version.py未正常安装时返回0.0.0可据此判断包是否安装成功。5.2 常见问题排查依赖冲突Transformers 与飞桨共存推理引擎间可能存在依赖冲突建议每个环境只保留一种推理引擎训练与导出路径同样建议在全新环境安装Python 版本不符安装doc-parser、ie、trans、all等依赖组需要 Python 3.9基础 OCR 能力与doc2md支持 3.8GPU 无法使用优先核对显卡驱动版本而非物理机 CUDA 版本驱动版本要求参见 飞桨框架安装产线依赖组不确定各产线所属依赖组见对应产线文档例如 PP-StructureV3、PP-ChatOCRv4、PP-DocTranslation按表安装对应组即可。6. 两种安装路径速查表| 场景 | 安装方式 | Python 版本 | 是否需飞桨 | | - | - | - | - | | 通用 OCR / 文档图像预处理推理 |python -m pip install paddleocr| ≥ 3.8 | 按所选推理引擎默认飞桨 | | 文档解析PP-StructureV3 等 |python -m pip install paddleocr[doc-parser]| ≥ 3.9 | 按所选推理引擎 | | 关键信息抽取PP-ChatOCRv4 等 |python -m pip install paddleocr[ie]| ≥ 3.9 | 按所选推理引擎 | | 文档翻译PP-DocTranslation 等 |python -m pip install paddleocr[trans]| ≥ 3.9 | 按所选推理引擎 | | 办公文档转 Markdown |python -m pip install paddleocr[doc2md]| ≥ 3.8 | 否 | | 全部推理能力 |python -m pip install paddleocr[all]| ≥ 3.9 | 按所选推理引擎 | | 模型训练 / 导出 | 克隆仓库 pip install -r requirements.txt| ≥ 3.8 | 必须先装飞桨框架 |按需选择、按表安装即可在最小依赖体积下获得完整的 PaddleOCR 3.5 推理与训练能力。【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考