文档

PDF万能大师

试用

全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB"

它能做什么

全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB""审查合同""批量盖章""彻底删除"等指令时触发。飞书机器人场景原生支持。

技能文档

万能 PDF 大师

一站式 PDF 处理系统,25 项能力按四层组织。本文件是路由与流程主控:所有能力的详细执行规程、质量标准、错误降级、价值话术均在 references/ 中按需加载。


核心工作流

每个请求严格按 5 步执行:

Step 0: 环境闸门(首次使用或脚本报 ImportError 时)

运行 python3 scripts/check_env.py 查看能力就绪矩阵:

  • 核心缺失 → 引导用户执行 bash setup.sh(或 pip install -r requirements.txt),装好再继续
  • 增强项缺失 → 不阻断,按 references/error-handling.md 降级链执行并告知质量差异
  • 环境齐备时跳过本步,不要每次请求都跑

Step 1: 接收与检测

收到 PDF 后先运行 scripts/pdf_info.py 获取:页数、大小、加密状态、文本层有无、扫描件占比、元数据。未检测不得开始处理。

检测结果路由
有文本层文本型管道(PyMuPDF / pdfplumber)
无文本层、纯图像OCR 管道(先读 references/ocr-config.md
部分文本+部分图像混合管道(文本页直取,图像页 OCR)
加密文件索要密码;无法提供则终止并说明

Step 2: 意图路由

用「能力路由总表」匹配用户指令到能力编号。匹配规则:

  1. 单意图命中 → 直接进入对应能力规程
  2. 复合指令(如"按日期重命名后合并成带目录的手册")→ 拆成能力链,按依赖顺序执行(重命名 #11 → 合并 #5),每步完成后汇报
  3. 意图模糊(如"处理一下这个文件")→ 列出最可能的 2-3 个能力让用户选择,不得自行猜测执行
  4. 无法匹配 → 说明能力边界,推荐最接近的能力

20 个带标准路由的 Few-Shot 示例见 references/few-shot-examples.md,路由拿不准时先查它。

Step 3: 执行前确认

以下情况必须先确认再动手:

  • 批量任务(>10 文件):报出文件数、预计耗时、将执行的操作清单
  • 不可逆操作(密文删除 #25、批量替换 #20、直接编辑 #3):展示预览/差异,等用户说"确认"
  • 目标参数缺失(压缩没说目标大小、改名没给规则):给出默认值并询问是否采用

Step 4: 执行与进度反馈

  • 确定性操作优先调用 scripts/ 下脚本,不重复造轮子
  • 长任务(>30 秒)每 20-30 秒发一次进度:"正在解析第 3/20 页…"
  • 任一环节失败 → 按 references/error-handling.md 的降级链处理,不得静默失败

Step 5: 交付与价值确认

交付时四件事缺一不可:

  1. 结果文件:上传文件 / 发文本 / 给多维表格链接
  2. 质检结论:按 references/quality-standards.md 对应能力的验收项自检并报告(如"表格 12 个全部原生可编辑,图片偏移 <5px")
  3. 异常清单:跳过的页、失败的文件、降级的环节,逐一明示
  4. 价值反馈:一句话省时/省钱/避险对比,话术从 references/value-messaging.md 取,不得编造数字

能力路由总表

第一层 · 五大核心(详细规程 references/capabilities-core.md

#能力触发关键词脚本
1PDF↔Office 高保真互转转Word / 转Excel / 转PPTpdf_convert.py
2扫描件 OCR 精准识别OCR / 识别 / 扫描件转文字pdf_ocr.py
3PDF 内直接编辑改文字 / 改参数 / 替换图片—(规程执行)
4安全保护(加密/权限/水印)加密 / 加水印 / 禁止打印pdf_watermark.py
5批量自动化处理批量合并 / 拆分 / 重命名pdf_merge.py pdf_split.py

第二层 · 九大增值(详细规程 references/capabilities-value.md

#能力触发关键词脚本
6表格精准提取提取表格 / 表格转Excelpdf_extract_tables.py
7图文混排解析提取图文 / 解析内容—(规程执行)
8智能摘要摘要 / 总结 / 提炼重点—(LLM 执行)
9自动脱敏脱敏 / 打码 / 隐藏敏感信息—(规程执行)
10元数据清洗清洗元数据 / 擦除痕迹pdf_info.py --scrub
11名称/编号自动化自动命名 / 重命名—(规程执行)
12两版差异对比对比 / diff / 版本差异—(规程执行)
13文档即问即答问答 / 这份文件说了什么—(RAG 规程)
14规格参数对比矩阵规格对比 / 参数对比—(规程执行)

第三层 · 四大扩展(详细规程 references/capabilities-pro.md

#能力触发关键词脚本
15PDF 智能压缩压缩 / 压到xxMB / 缩小pdf_compress.py
16PDF 翻译(保留排版)翻译 / 翻成中文 / 双语对照—(规程执行)
17合同智能审查审查合同 / 合同体检 / 标风险—(规程执行)
18发票/票据自动归档归档发票 / 报销汇总 / 验真—(规程执行)

第四层 · 七大壁垒(详细规程 references/capabilities-pro.md

#能力触发关键词脚本
19电子签名与审批流签名 / 电子签 / 批量盖章 / 审批流—(规程执行)
20批量内容替换批量替换 / 统一改价格 / 换Logopdf_batch_replace.py
21PDF 表单创建生成表单 / 可填写PDF / 问卷转表单—(规程执行)
22图纸精准测量测量图纸 / 量尺寸 / 算面积—(规程执行)
23翻页电子书制作翻页书 / 电子书 / 手册转网页—(规程执行)
24印刷级导出印刷导出 / CMYK / 出血区 / 转曲—(规程执行)
25密文级敏感信息删除彻底删除 / 永久抹除 / 不是涂黑pdf_redact.py

硬性约束

约束项限制超限处理
单文件大小≤100MB建议先压缩(#15)或拆分(#5)
单任务页数≤200 页引导用户指定页范围
OCR 单批≤50 页自动分批,批间报进度
并发任务≤3排队并告知预计等待
单任务超时5 分钟熔断,保留中间结果,报告已完成部分
批量替换≤500 文件/批分批执行
密文删除≤200 文件/批分批执行
批量确认阈值>10 文件必须先确认清单

安全红线

  • 涉密文档(用户声明或检测到密级标记)→ 全程本地模型,禁上云,详见 references/security-compliance.md
  • 密文删除(#25)与脱敏(#9)是不同操作:#9 是遮盖可恢复,#25 是删除底层对象不可恢复,用户说"涂黑/打码"走 #9,说"彻底/永久/真删"走 #25,不得混用
  • 脱敏/删除前必须预览确认,执行后必须验证扫描并出报告
  • 发票验真(#18)、电子签名(#19)依赖外部接口;接口不可用时明确告知"未验真/无法律效力签名",不得伪造结果

资源索引

文件何时读取
setup.sh + requirements*.txt首次部署/装依赖(bash setup.sh 一键;--check 仅自检)
scripts/check_env.py能力就绪矩阵自检
references/capabilities-core.md执行能力 1-5 前
references/capabilities-value.md执行能力 6-14 前
references/capabilities-pro.md执行能力 15-25 前
references/few-shot-examples.md意图路由拿不准时
references/quality-standards.md交付前自检
references/error-handling.md任何环节失败时
references/security-compliance.md涉密/脱敏/删除/签名任务前
references/command-guide.md用户问"你能做什么"时
references/value-messaging.md交付时取价值话术
references/tech-spec.md需要理解技术栈/管线细节时
references/ocr-config.mdOCR 任务调参或识别效果差时
references/feishu-setup.md飞书部署/联调/排障时

相关技能

PDF格式转换与处理工具。触发词:PDF转PPT、PDF转Word、PDF转Excel、PDF转图片、PDF格式转换、把PDF转成PPT、PDF去水印、移除水印、PDF表单填写、填写PDF表格、批量提取PDF表格、外文PDF翻译。即使用户没说'转换',只要提到'PDF里的表提取到Excel''这个报告能不能编辑''去掉这个水印''把这个英文PDF翻成中文'也应触发。不适用:非PDF输入、PDF内容分析/摘要(用pdf skill)、扫描件OCR识别。

1 次安装

综合PDF处理工具包:文本表格提取、PDF创建、合并拆分、水印、加密、OCR识别。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 次安装

Use this skill whenever the user wants to do anything with PDF files. This includes reading or extracting text/tables from PDFs, combining or merging multipl...

3 次安装

PDF toolkit: extract, merge, split, compress, convert, watermark, and protect PDFs.

4 次安装

中文PDF处理器 - (免费版) 核心能力: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别 适用场景: 个人用户日常使用,核心功能覆盖基础需求 差异化: 精简版,适合个人用户快速上手,提供核心功能与基础用法 适用关键词: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别

1 次安装

ifly-pdf-image-ocr skill supporting both image OCR (AI-powered LLM OCR) and PDF document recognition. Use when user asks to OCR images, extract text from ima...

3 次安装