跳转至

Python-native PDF toolkit

Python的方式处理PDF,核心由Rust驱动。

用一套熟悉的API完成PDF编辑、渲染、提取与最终处理,无需沉重的运行时依赖。

pip install pylopdf
  • MIT许可
  • 约3.5 MB wheel
  • 零运行时依赖
  • Python 3.10–3.14
01 / EDIT

精准编辑

合并、选页、添加批注、填写表单,并保留关键的PDF结构。

02 / RENDER

忠实渲染

通过紧凑的原生引擎,将页面稳定输出为PNG或SVG。

03 / EXTRACT

提取信息

通过统一API读取文本、单词、区块、坐标与OCR不可见文本层。

Useful constraints, visible evidence

足够轻,便于部署;足够完整,胜任真实工作流。

pylopdf使用lopdf进行编辑,使用Typst采用的纯Rust渲染器hayro进行渲染, 并将它们组合成一个刻意保持紧凑的Python包。

约3.5 MB 当前wheel大小,适合AWS Lambda等容量受限的环境。
0 运行时依赖。安装一个wheel即可开始处理PDF。
3.10–3.14 单一abi3 wheel系列覆盖五代Python。
MIT 宽松许可,适合开源与商业产品。

Deliberate scope

专注的PDF核心,与Python生态系统协同工作。

项目公开可复现的性能基准,包括不占优势的结果;相邻领域则采用成熟工具, 而不是重复实现。

pylopdf负责

  • 页面管理、元数据、书签与加密
  • 带坐标的文本提取、搜索与Markdown转换
  • PNG/SVG渲染、图像、批注与OCR文本层
  • AcroForm填写、附件与页码标签

通过生态协作

  • 使用Typst排版并生成新的PDF/A
  • 使用pyHanko添加PAdES签名
  • 使用veraPDF验证PDF/A
  • 连接任何能够返回单词与矩形的OCR引擎