# PDF文字与页面定位提取

提取有文字层的PDF，并保留页码和阅读顺序。

用途：AI 技能

分类：AI技能

许可：MIT

原版名称：pdf-extraction

来源：https://github.com/claude-office-skills/skills

公开页面：https://xwtx.zbidea.cn/discover/skills/SK-018

继续使用：https://xwtx.zbidea.cn#/skills/SK-018

## 准备资料
- PDF
- 指定页码
- 目标字段

## 目标输出
- 正文提取
- 页码索引与失败页说明

## 运行条件与边界
- 需要 Python/pdfplumber；扫描PDF需另配OCR，不包含OCR模型。

