Documents

Deep Doc Processor

Try it

智能文档深度处理器。当用户需要总结文档、提炼长文核心观点、生成结构化分析报告、对多份资料交叉对比、或基于文档内容进行多轮深度问答时自动触发。支持 PDF/Word/Markdown/网页/纯文本等多种格式。关键词:总结、摘要、提炼、分析报告、文档问答、深度阅读、信息提取、交叉对比。

What it does

智能文档深度处理器。当用户需要总结文档、提炼长文核心观点、生成结构化分析报告、对多份资料交叉对比、或基于文档内容进行多轮深度问答时自动触发。支持 PDF/Word/Markdown/网页/纯文本等多种格式。关键词:总结、摘要、提炼、分析报告、文档问答、深度阅读、信息提取、交叉对比。

The skill document

智能文档深度处理器 (Deep Doc Processor)

核心能力

对用户提供的一个或多个文档(PDF/Word/Markdown/TXT/网页)执行深度智能处理:

  1. 分层摘要:生成一句话总结 → 段落级摘要 → 全文结构化大纲,逐层深入
  2. 逻辑提炼:自动识别文档中的论点-论据链、因果关系、矛盾点
  3. 交叉对比:多份文档并排对比,输出差异矩阵与共识结论
  4. 结构化报告:一键生成包含「核心观点 / 关键数据 / 行动建议 / 风险提示」的专业分析报告
  5. 多轮问答:基于文档内容进行追问、深挖、假设推演

触发条件

当用户消息包含以下任意模式时,自动加载本 skill:

  • 上传文档并要求"总结"/"摘要"/"提炼"/"帮我看看"
  • 提供网页链接并要求"分析"/"拆解"/"提取要点"
  • 多份资料要求"对比"/"找差异"/"交叉分析"
  • 对已读文档追问细节、要求深挖某个观点
  • 要求"生成报告"/"做一份分析"/"整理成文档"

操作指令

1. 文档读取阶段

根据文件类型选择正确的读取方式:

  • PDF / DOCX / XLSX / PPTX:派发给 file-agent,使用其 read_file 工具
  • 纯文本 / Markdown / 代码:使用主 Agent 的 read_text 或派发 file-agent
  • 网页 URL:使用 web_fetch 抓取正文,如遇登录墙则改派 browser-agent
  • 图片中的文字:使用 analyze_image 做 OCR 提取

2. 处理阶段

读取完成后,按用户需求选择处理深度:

用户需求处理方式输出格式
"帮我总结一下"分层摘要(3层)一句话 → 段落摘要 → 大纲
"提炼核心观点"论点提取 + 论据链观点列表 + 支撑证据
"对比这两份文档"交叉对比分析差异矩阵 + 共识结论
"生成分析报告"全流程处理结构化报告(见下方模板)
追问/深挖基于原文精准定位引用原文 + 解读

3. 结构化报告模板

当用户要求生成报告时,按以下模板输出并写入文件:

# [文档标题] 深度分析报告

## 一、一句话总结
[用一句话概括全文核心内容]

## 二、核心观点
1. **[观点一]**:展开说明(附原文依据)
2. **[观点二]**:展开说明(附原文依据)
...

## 三、关键数据
| 指标 | 数值 | 来源 |
|------|------|------|
| ... | ... | ... |

## 四、行动建议
- 建议一
- 建议二

## 五、风险与注意事项
- 风险点一
- 风险点二

---
*生成时间:YYYY-MM-DD HH:MM*
*处理文档:[文档路径/URL]*

4. 多文档对比模板

# 多文档交叉对比报告

## 对比维度
| 维度 | 文档A | 文档B | 文档C |
|------|-------|-------|-------|
| 核心立场 | ... | ... | ... |
| 关键论据 | ... | ... | ... |
| 数据差异 | ... | ... | ... |

## 共识结论
1. ...
2. ...

## 分歧点
1. ...
2. ...

安全约束

  • 文档内容涉及个人隐私(身份证号、银行卡号、密码等)时,报告中自动脱敏为 ***
  • 不修改原始文档,所有产出物写入 output 目录
  • 涉及敏感商业文档时,提醒用户注意信息安全

使用示例

用户:"帮我总结这份投资报告,提炼核心观点和风险提示"
→ 读取文档 → 分层摘要 → 结构化报告 → 写入 output 目录 → 展示报告卡片

用户:"对比这三份竞品分析文档"
→ 并行读取三份 → 交叉对比 → 差异矩阵 → 写入 output 目录

用户:"文档里提到的Q3增长原因是什么?"
→ 基于已读文档精准定位 → 引用原文 → 解读

Related skills

This skill should be used when a user provides an academic paper (PDF file, DOI, arXiv link, or title) and asks for a structured deep-read report or literature summary. It extracts the full paper text, quotes exact numbers from the original, and produces a deep, visually structured report with a mec

本地文档读取技能。从 PDF / DOCX / TXT 抽取纯文本与结构(标题/段落/表格),供摘要、检索、结构化抽取下游使用。内置 doc_extract 脚本(优先本地库,无依赖时回退提示)。适用于合同/简历/报告解析、知识入库、长文预处理。

会议深度加工与质量增强引擎——平台无关的会议数据5域27任务技能。加工层(D01-D04):个体12维角色剖面分析、个体间群体动力关系分析、会议整体执行分析与知识沉淀。增强层(D05):会前亮点设计→会中深度干预→会后质量诊断(评分→根因→改进)→跨会议模式优化,形成"加工→诊断→改进→再加工"质量闭环。适配协作/决策/创意/谈判/调解/评估/信息/仪式8种会议场景。触发词:会议分析、会议加工、会议深度加工、录制分析、转写分析、深度加工、会议纪要、会议改进、会议质量、meeting deep process、meta-skill-system

1 installs

通用文档解析工具,支持PDF、图片、扫描件的结构化信息提取与OCR识别。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 installs

当用户说「深度研究 X」「深入研究 X」或要求生成某产品、公司、概念、人物、产业链、政策、趋势的深度研究/发展研究报告时触发,自动进行联网搜索和研究,产出排版后的 PDF 文档,总字数通常 1-3 万字。

2 installs

中文PDF处理器 - (免费版) 核心能力: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别 适用场景: 个人用户日常使用,核心功能覆盖基础需求 差异化: 精简版,适合个人用户快速上手,提供核心功能与基础用法 适用关键词: 中文PDF, PDF解析, 中文OCR, 表格提取, 版面分析, 智能分块, 双栏识别

1 installs