综合PDF处理工具包:文本表格提取、PDF创建、合并拆分、水印、加密、OCR识别。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
Documents
中文PDF处理器(免费版)
Try it中文PDF处理器 - (免费版) 核心能力: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别 适用场景: 个人用户日常使用,核心功能覆盖基础需求 差异化: 精简版,适合个人用户快速上手,提供核心功能与基础用法 适用关键词: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别
What it does
中文PDF处理器 - (免费版) 核心能力: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别 适用场景: 个人用户日常使用,核心功能覆盖基础需求 差异化: 精简版,适合个人用户快速上手,提供核心功能与基础用法 适用关键词: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别
The skill document
中文PDF处理器(免费版)
概述
中文PDF处理器是针对PDF处理领域的专业化AI辅助工具。免费版面向个人用户,提供核心功能与基础用法,适合快速上手和日常使用. 本工具经过深度优化,增强元数据和适用关键词,完全适配SkillHub平台规范.
核心能力
中文OCR、版面分析、中文表格提取、智能分块、中文文本校正、双栏识别
核心能力(补充)
执行核心能力操作,使用input_params参数进行配置,支持创建/查询/导出等操作.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
基础功能完整覆盖
基础功能完整覆盖
处理: 解析基础功能完整覆盖的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回基础功能完整覆盖的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
简洁易用的操作接口
简洁易用的操作接口
处理: 解析简洁易用的操作接口的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回简洁易用的操作接口的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
标准格式输入输出
标准格式输入输出
处理: 解析标准格式输入输出的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回标准格式输入输出的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
快速上手
快速上手,零配置即可使用
处理: 解析快速上手的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回快速上手的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
适合个人日常使用场景
适合个人日常使用场景
处理: 解析适合个人日常使用场景的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回适合个人日常使用场景的响应数据,包含状态码、结果和日志.
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
处理: 解析核心能力的输入参数,完成核心逻辑,返回结构化响应.
输出: 返回核心能力的响应数据,包含状态码、结果和日志.
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置.
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:针对中文、PDF、优化的处理工具、支持中文、表格提取与智能分、处理器、免费版等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.
使用场景
场景1:中文PDF解析
解析中文PDF文档,提取文本和表格。示例指令:`
`解析这份中文报告
操作流程:
- 识别用户需求类型
- 加载对应处理模块
- 执行操作并返回结果
场景2:中文OCR识别
对扫描的中文文档进行OCR识别。示例指令:`
`OCR识别这份扫描文档
场景3:中文表格提取
从中文PDF中提取表格数据。示例指令:`
`提取PDF中的中文表格
快速开始
- 阅读## 核心能力章节了解skill功能
- 按## 依赖说明配置环境
- 执行所需能力对应的命令
- 参考## 错误处理章节处理异常
- 查看## FAQ解答常见疑问
环境准备
输入格式
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| input | string | 是 | 中文PDF处理器(免费版)处理的输入数据或指令 |
| options | object | 否 | 附加配置选项,如模式选择、格式偏好等 |
| callback_url | string | 否 | 异步处理完成后的回调通知URL |
# 确保Python环境可用
python3 --version
# ...
# 依赖说明
pip install requests
基础用法
# 中文PDF处理基础
from pypdf import PdfReader
# ...
def parse_cn_pdf(pdf_path):
reader = PdfReader(pdf_path)
text = ""
for page in reader.pages:
text += page.extract_text() or ""
return text
# ...
text = parse_cn_pdf("chinese_doc.pdf")
print(f"提取文本长度: {len(text)}")
print(text[:200])
执行结果
完成上述代码后,将根据输入参数返回结构化响应。免费版支持单次任务,适合解析单个文件或任务.
示例
cn_pdf:
text_extraction: pdfplumber
table_extraction: basic
ocr: false
output_format: txt
配置说明
| 配置项 | 说明 | 默认值 |
|---|---|---|
| 基础路径 | 工作目录 | ./ |
| 输出格式 | 结果输出格式 | json |
最佳实践
基础使用建议
- 明确需求:在使用前明确需要处理的内容和期望结果
- 检查输入:确保输入文件格式正确、内容完整
- 保存结果:处理完成后及时保存输出结果
- 定期清理:定期清理临时文件
- 错误处理:遇到错误时检查输入参数
性能优化
# 免费版:单文件优化
# 确保输入文件不超过建议大小
# 处理完成后释放资源
常见问题
Q1: 处理速度较慢怎么办?
A: 免费版为单线程处理,对于大文件建议分批处理或升级到专业版获得并行处理能力.
Q2: 支持的文件格式有哪些?
A: 支持标准格式输入输出,常见格式包括JSON、YAML、Markdown等.
Q3: 如何获取API Key?
A: 本skill基于Markdown指令规范,无需额外API Key。如需外部服务API,请参考对应服务的注册流程.
已知限制
A: 免费版支持单次操作,适合个人日常使用。如需批量处理或高级功能,建议升级到专业版.
依赖说明
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- 操作系统: Windows / macOS / Linux
- Python版本: 3.8+
第三方依赖
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| pypdf | Python库 | 必需 | pip install pypdf |
| pdfplumber | Python库 | 必需 | pip install pdfplumber |
| pytesseract | Python库 | 可选 | pip install pytesseract |
| pdf2image | Python库 | 可选 | pip install pdf2image |
| pandas | Python库 | 可选 | pip install pandas |
| tesseract | 系统工具 | 可选 | OCR功能需要安装Tesseract |
API Key 配置
- 本skill基于Markdown指令规范,无需额外API Key
可用性分类
- 分类: MD+EXEC(纯Markdown指令,部分功能需要exec命令行执行能力)
- 说明: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作
- 版本: 免费版(v1.0.0 免费版,核心功能)
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
输出格式
{
"success": true,
"data": {
"result": "中文PDF处理器(免费版)处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "pdf processor cn"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}
Related skills
通用文档解析工具,支持PDF、图片、扫描件的结构化信息提取与OCR识别。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。
核心能力: 文档处理领域的专业化 AI 辅助工具,提供核心基础功能支持. 适用场景: 个人用户与轻量级场景,涵盖日常操作、自动化工作流与智能决策辅助. 差异化: FREE 版本,面向个人用户提供核心功能、简洁操作与社区支持. 适用关键词: powerpoint, pptx, 中文, 演示文稿, 幻灯片, 排版, 本地化
PDF格式转换与处理工具。触发词:PDF转PPT、PDF转Word、PDF转Excel、PDF转图片、PDF格式转换、把PDF转成PPT、PDF去水印、移除水印、PDF表单填写、填写PDF表格、批量提取PDF表格、外文PDF翻译。即使用户没说'转换',只要提到'PDF里的表提取到Excel''这个报告能不能编辑''去掉这个水印''把这个英文PDF翻成中文'也应触发。不适用:非PDF输入、PDF内容分析/摘要(用pdf skill)、扫描件OCR识别。
全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB"
Convert PDF and image files into 10 document and data formats, with OCR and layout controls.