工具 / OT-006
PDF页面与文字提取
用本地脚本组合PDF页面、提取文字和处理文档信息。
查看运行条件与资源浏览同类资源准备什么
可以得到什么
- 提取文字
- 文档信息
运行条件与使用边界
- Python及pypdf
- 不执行OCR
- 扫描件需要另配OCR
- 文本阅读顺序可能需要整理。
- 已核验上游源码与文档,未在本机安装或运行测试。
来源与许可
- 用途分类
- PDF与扫描
- 开源项目
- pypdf
- 许可
- BSD-3-Clause
- 固定提交
- 1a6b0502e26d2430b6370f8ebf7a647ba2623a4f
选择资源后,按交付详情下载文件和说明,交给支持所需能力的 AI 继续修改。素材使用、第三方依赖与项目托管分别按对应说明办理。