# PDF页面与文字提取

用本地脚本组合PDF页面、提取文字和处理文档信息。

用途：工具

分类：PDF与扫描

许可：BSD-3-Clause

原版名称：pypdf

来源：https://github.com/py-pdf/pypdf

公开页面：https://xwtx.zbidea.cn/discover/tools/OT-006

继续使用：https://xwtx.zbidea.cn#/tools/OT-006

## 准备资料
- PDF

## 目标输出
- PDF
- 提取文字
- 文档信息

## 运行条件与边界
- Python及pypdf
- 不执行OCR
- 扫描件需要另配OCR
- 文本阅读顺序可能需要整理。
- 已核验上游源码与文档，未在本机安装或运行测试。

