Coding

long-text-summarizer

Try it

长文/超长文档摘要技能。基于 Map/Reduce 与分层归约(hierarchical reduce)把超出模型上下文的 文本可靠地浓缩成结构化摘要;支持按格式/长度/语气/聚焦维度定制输出。当需要摘要论文、报告、 书籍、聊天记录、长网页、批量文档时使用。

What it does

长文/超长文档摘要技能。基于 Map/Reduce 与分层归约(hierarchical reduce)把超出模型上下文的 文本可靠地浓缩成结构化摘要;支持按格式/长度/语气/聚焦维度定制输出。当需要摘要论文、报告、 书籍、聊天记录、长网页、批量文档时使用。

The skill document

long-text-summarizer —— 长文摘要(Map/Reduce 工作流)

当用户要摘要超过模型单次上下文的文本(论文、财报、书籍、长聊天记录、批量文档)时使用本技能。 核心思想:分块摘要(Map) → 归约汇总(Reduce),而非一次性丢给模型(会超长或被过度压缩)。

何时用

  • 原文预计 > 模型上下文窗口(中文约 >6000 字 / ~3000 token 就应考虑分块)
  • 需要可控格式(要点 / 一段式 / 执行摘要)、可控聚焦(只看风险 / 决策 / 结论)
  • 批量文档(多文件各自摘要后再做全局归约)

工作流(三步)

1. 分块(Map 准备)

用自带分块器把文档切成可管理的块(带重叠以保留边界语义):

python scripts/chunker.py <文件> --mode markdown --chunk 2000 --overlap 200 --out chunks.json
# 支持 .txt/.md/.docx(需 python-docx);--mode markdown 优先按标题切,更贴语义边界

得到 JSON:{ chunks: [{ index, text }, ...] }

2. 逐块摘要(Map)

每个块用统一 Map 提示词独立摘要(可并行/逐块调用模型):

请摘要以下片段 [chunk-{index}]。要求:
- 只列要点,不要散文
- 提取明确的数字、日期、约束
- 原文没有的信息写"未提及"
- 引用块编号:[chunk-{index}]
片段内容:
{chunk_text}

3. 归约(Reduce) —— 选一种

  • 朴素归约:把所有块摘要拼起来再摘要一次(中短文可用)。
  • 分层归约(推荐,长文档):100 块×200 token = 2 万 token,会超上下文 → 分批归约成中间摘要,再对中间摘要做最终归约(递归直到 ≤1 批)。
  • 迭代精炼(Refine):顺序处理,每读一块就精炼已有摘要;⚠️ 早期错误会累积,仅建议短文档(<10 块)。

最终归约提示词:

请根据以下局部摘要列表,生成全局总结:
1. 按时间/逻辑顺序排列关键事件
2. 标注不同观点的冲突点
3. 保留 [chunk-N] 引用
4. 长度不超过 300 字(或用户指定)
局部摘要:
{all_chunk_summaries}

输出定制(提示词模板维度)

维度取值示例
格式1句话 / 3要点 / 执行摘要 / 章节高亮
语气通俗 / 专业 / 高管风格
聚焦只看风险 / 只看决策 / 只看结论 / 只看数字

质量要点

  • 块越小越细;控制细节程度靠调 --chunk 与块数。
  • 跨块主题可能丢失 → 分层归约后做一次"全局主题"补扫。
  • 绝不一次性投喂整篇超长文。

自进化学习系统

本技能会随使用自我复盘(详见 scripts/learner.py 用法)。每次摘要后建议记录:

python scripts/learner.py record <技能目录> --capability 长文摘要 [--fail --error <类型> --note <说明>]
python scripts/learner.py reflect  <技能目录>   # 错误≥3次给改进建议,操作≥10次做高低频分析

reflect 发现反复失败的模式(如某类文档分块效果差),应据此改进本 SKILL.md 的分块策略或提示词,形成越用越好用的闭环。

Related skills

Quickly summarize any text, URL, or file content into a concise structured brief. Use when the user wants a TL;DR, executive summary, or needs to distill long content into key points without reading the full source.

长文本推理基础工具(免费版)。针对商业合同、备忘录、提案等长文档,提供文档评估、核心逻辑提取与基础风险检测 三大基础能力,帮助快速梳理文档结构与识别明显风险。覆盖目的识别、主张提取、歧义与矛盾检测等基础分析. 适用于合同审查准备、备忘录摘要等基础场景。如需多版本对比、风险转移条款识别、结构改进建议、护栏机制等 高级能力,请升级至ai-assistant付费版。本Skill提供分析支持,不替代持牌法律意见.

Generates condensed album highlights based on specified keywords or targets. It extracts specific target segments from long videos and compiles them into an exciting summary. | 时光相册自定义浓缩分析技能,基于指定关键词/目标生成时光相册浓缩集锦,从长视频中提取特定目标片段,整理生成精彩汇总

21 installs4 stars

Compress any source while preserving every claim, hedge, number, and attribution.

240 installs5 stars

起草、改写、润色、扩写、压缩、规范并导出中文公文与行政正式文本。Use when the user asks to write, revise, summarize, standardize, or convert 公文、决议、决定、命令、公告、公报、通告、意见、通知、通报、报告、请示、批复、议案、函、纪要,以及...

19 installs

Rewrite weak skill summaries into sharper storefront copy. 把模糊、冗长、像模板的 skill 摘要改成更短、更清楚、更容易被安装的版本。

2 installs