AI工具 Skill技能库 关于道场

PDF/图片文字提取助手:扫描件OCR+表格结构化+批量处理

一人堂 |2026-09-01

PDF/图片文字提取工具,本地提取 PDF 文字(含扫描件 OCR)、图片文字、表格结构化。基于 PyPDF2/PaddleOCR,支持批量处理,输出文本/Markdown/CSV,无需付费 API。适合处理合同、报告、扫描件等文档。


slug: pdf-ocr-extractor-cn displayName: PDF/图片文字提取神器 version: 1.1.0 description: PDF/图片文字提取 Skill。本地提取:① PDF 文字(含扫描件 OCR)② 图片文字 ③ 表格结构化。基于 PyPDF2/PaddleOCR,支持批量处理,输出文本/Markdown/CSV。无需付费 API。 homepage: https://github.com/zhaoheng588-tech/ai-skills-collection/skills/pdf-ocr license: MIT tags: [ai-skill]

PDF/图片文字提取神器

功能

PDF/图片文字提取 Skill。本地提取:① PDF 文字(含扫描件 OCR)② 图片文字 ③ 表格结构化。基于 PyPDF2/PaddleOCR,支持批量处理,输出文本/Markdown/CSV。无需付费 API。

使用流程

1. 用户提供输入(要提取PDF文字、扫描件识别、图片转文字、表格提取) 2. 按下方核心步骤处理 3. 输出结构化结果(报告/代码/文件)

依赖安装(开箱即用)

```bash pip install PyPDF2 pip install paddleocr paddlepaddle # 仅扫描件 OCR 需要 ```

PyPDF2(必需)+ PaddleOCR(可选 OCR)

> 未安装依赖时脚本会提示缺什么,安装后即可使用。数据/处理全部本地完成。

直接提问模板(复制即可用)

> 帮我提取这个 PDF/图片的文字:<文件路径>。

异常处理(遇到问题时)

情况正确处理
扫描件无文字层提示'需 OCR,请安装 paddleocr'
图片模糊提示'识别率可能低,建议清晰原图'

不适用场景(诚实说明)

- 仅处理用户本地文件 - 涉及版权内容仅限个人合法使用 - 不上传任何文件(本地处理)

FAQ(常见问题)

Q:要装什么? PyPDF2 必需;扫描件 OCR 需 PaddleOCR。 Q:能批量吗? 能,batch 命令批量处理目录。 Q:表格能提取吗? 基础表格可提取为文本/CSV,复杂表格建议人工核对。

核心原则

本地运行;扫描件需装 PaddleOCR;表格输出 CSV

输入要求

- 明确告知用户需要提供的信息 - 信息不足时先提问补齐,不臆造

输出说明

- 结构化输出(表格/Markdown/代码/文件) - 附使用说明与注意事项

合规声明

- 本 Skill 输出为辅助工具结果,不构成专业意见/投资建议/法律意见 - 涉及用户数据时本地处理、不上传 - 请遵守各平台服务条款与相关法规


来源:GitHub https://github.com/zhaoheng588-tech/ai-skills-collection