Documents

内容蒸馏器

Try it

从任何内容(电子书/链接/视频/文案)中蒸馏可复用方法论,并自动封装为体系化技能包。支持PDF/EPUB/TXT/MD电子书、小红书/抖音/B站/视频号等平台链接、本地视频、公众号文章、直接文案六种输入源。触发词:蒸馏、帮我蒸馏、提取方法论、把这本书变成技能、生成技能包、book to skills、从这门课程里...

What it does

从任何内容(电子书/链接/视频/文案)中蒸馏可复用方法论,并自动封装为体系化技能包。支持PDF/EPUB/TXT/MD电子书、小红书/抖音/B站/视频号等平台链接、本地视频、公众号文章、直接文案六种输入源。触发词:蒸馏、帮我蒸馏、提取方法论、把这本书变成技能、生成技能包、book to skills、从这门课程里提取、这个方法论归我了、帮我沉淀方法论。

The skill document

技能造物主

从任何内容(电子书/链接/视频/文案)中蒸馏可复用方法论,自动封装为体系化技能包(方法论+参考资料+成功实例+失败实例+边界实例+局限性分析)。核心目标:把别人的书/课程/干货变成你自己的、有判断力的、可调用的技能包。

输入源识别(Step 0)

根据用户提供的输入类型,自动选择处理路径:

输入类型识别信号处理路径
电子书文件文件后缀 .pdf / .epub / .txt / .md路径 E:电子书拆解
平台链接包含 xiaohongshu.com / douyin.com / bilibili.com / weixin.qq.com路径 A:链接蒸馏
知识星球链接包含 zsxq.com / wx.zsxq.com路径 B:星球帖子蒸馏
本地视频文件文件后缀 .mp4 / .mov / .avi路径 C:视频蒸馏
直接文案用户粘贴大段文字路径 D:文案蒸馏
公众号文章包含 mp.weixin.qq.com路径 A:链接蒸馏

路径 E:电子书拆解(新增)

当输入是电子书文件时,执行以下流程:

E.1 格式识别与文本提取

格式提取方式
PDFpython3 scripts/extract_pdf.py
EPUBpython3 scripts/extract_epub.py
TXT / MD直接读取

E.2 书籍结构分析

提取文本后,执行结构化分析:

  1. 书籍元信息:书名、作者、主题领域、核心主张
  2. 章节结构:目录层级(章→节→小节),每章核心主题
  3. 核心概念清单:每个概念用 1-2 句话概括
  4. 可落地方法论:识别书中明确的操作步骤、框架、checklist
  5. 知识产品化信号:哪些内容可变成课程/星球帖/公众号文章
  6. 技能拆分建议:建议生成几个 skill,每个的主题和边界

E.3 输出模式选择(用户确认)

请选择技能生成模式:

A) 📚 知识库式 — 生成1个综合知识库 skill,覆盖全书知识点
B) ⚡ 行动指南式 — 为每个可落地方法论生成独立 action skill
C) 🔀 混合式(推荐) — 1个知识库 skill + N个行动 skill

你选哪个?

E.4 生成技能包

根据用户选择,生成以下结构:

  • 知识库 skill{book-slug}-knowledge/(SKILL.md + references/ 含 overview/concepts/quotes/structure)
  • 行动 skill{book-slug}-{method-slug}/(SKILL.md + 步骤指南 + checklist)

E.5 安装与交付

  • 所有生成的 skill 直接安装到 ~/.workbuddy/skills/
  • 生成 技能索引.md 汇总所有技能
  • 可选:打包为 zip 文件分发


一、体系化技能包结构

每个蒸馏出的方法论技能,必须是一个完整的体系化包,而非单文件:

方法论-{名称}/
├── SKILL.md                          # 必需 — 方法论主文档(含前置条件区块)
├── references/                        # 必需 — 参考资料目录
│   ├── 原始内容存档.md                #   原始内容去噪后完整存档(含来源链接)
│   ├── 理论原理.md                    #   方法论为什么有效的深度解释
│   ├── 相关方法论对照.md              #   与同类方法论的对比分析(至少对比2个)
│   └── 局限性分析.md                #   盲区、失效场景、反对观点(区分真方法论和鸡汤的关键)
├── examples/                          # 必需 — 实例目录
│   ├── 实例-01-成功.md               #   完整成功案例(背景→输入→操作→结果→复盘,含数据)
│   ├── 实例-02-成功.md               #   第二个成功案例,来自不同场景
│   ├── 实例-03-失败.md               #   失败案例:用错了导致失败
│   └── 实例-04-边界.md               #   边界案例:做了一半发现不适用,中途切换
├── templates/                         # 可选 — 模板目录(如有固定格式输出则必需)
│   ├── 模板-01.md                     #   可直接复用的模板
│   └── 检查清单.md                    #   操作检查清单(checklist)
└── scripts/                           # 可选 — 脚本(如有可自动化步骤则必需)
    └── helper.py                      #   辅助脚本

详细的目录规范、各文件职责、实例写作规范、局限性分析规范见 references/蒸馏框架.md 第四章。

templates/ 和 scripts/ 的触发规则

  • 方法论涉及固定格式输出 → templates/ 必需
  • 方法论涉及可自动化步骤 → scripts/ 必需
  • 否则标记为「可选」,技能包中可不包含。

二、核心工作流

Step 1:获取原始内容

根据用户提供的输入类型,选择获取方式(见上方 Step 0 输入源识别):

输入类型获取方式
电子书文件(PDF/EPUB/TXT/MD)运行 scripts/extract_pdf.pyscripts/extract_epub.py,或直接读取
平台链接(小红书/抖音/B站/视频号/微博等)调用「链接内容提取」技能,获取:标题、文案正文、视频文件、话题标签
知识星球帖子链接调用知识星球 MCP 工具获取帖子正文
公众号文章链接调用 WebFetch 抓取文章内容
本地视频文件调用「视频文案提取」技能,提取语音文案
直接提供文案/文字直接使用,跳过提取步骤

重要:内容提取阶段不要做蒸馏,先用已有技能把内容完整获取下来。

Step 2:内容预处理

获取到的原始内容需要做以下预处理:

  1. 去噪:移除广告、导流信息、无关的个人故事
  2. 分段:将长内容按主题分段,标注每段的核心意思
  3. 标记信号:用 【方法】/【技巧】/【心法】/【踩坑】/【反对观点】 标记五层蒸馏模型中的对应内容
  4. ⚠️ 关键:必须主动搜索评论区/弹幕/相关讨论,收集对这个方法的质疑和反对观点,这些是「局限性分析.md」的核心素材

Step 3:蒸馏方法论(核心步骤)

按五层蒸馏模型(见 references/蒸馏框架.md 第二章)逐层提取,重点在 Layer 3(方法论层)和 Layer 4(心法层)。

蒸馏输出格式(用于向用户展示,确认后再封装为技能包):

## 🧪 蒸馏结果:{方法论名称}

> ⚠️ 前置条件:使用这个方法论之前,你需要已经具备 {XX能力/XX资源}。如果还没有,建议先做 {XX方法论}。

### 来源信息
- 原内容:{链接或标题}
- 作者/平台:{来源}
- 蒸馏时间:{日期}
- 蒸馏层级:Layer {N}(方法论层/心法层/元认知层)

### 适用场景
{什么时候用这个方法论}

### 核心原理(为什么有效)
{1-2句话说清楚底层逻辑}

### 操作步骤(怎么做)
1. {步骤1}
2. {步骤2}
3. {步骤3}
...

### 局限性预览
- 失效场景:{什么情况下这个方法会失效}
- 反对观点:{有谁质疑过这个方法,理由是什么}
(完整分析见封装后的 references/局限性分析.md)

### 实例预览
- 成功实例:{简要描述1个成功场景}
- 失败实例:{简要描述1个失败场景}
- 边界实例:{简要描述1个中途不适用的场景}

### 常见误区
- {误区1}:{正确做法}
- {误区2}:{正确做法}

### 适用边界
- ✅ 适用:{场景}
- ❌ 不适用:{场景}

### 相关方法论
- {相关技能名}:{关系说明}

Step 4:决策 — 是否创建体系化技能包

不是所有蒸馏结果都要创建独立技能包。按以下标准判断:

条件创建体系化技能包存入统一方法论库
完整SOP/框架(≥3步)
单一技巧/话术(少于3步)
跨场景可复用
高度依赖特定平台/工具✅(标注依赖)
心法/原则类(抽象但重要)✅(知识型技能)
能写出具体成功实例(有数据)
无法构造实例(太抽象)

决策输出:向用户展示蒸馏结果,并说明「建议创建体系化技能包」或「建议存入方法论库」,等待用户确认。

Step 5:创建体系化技能包(用户确认后)

这是最关键的步骤。用户确认后,一次性创建完整的技能包目录和所有文件。

5.1 创建目录结构

mkdir -p ~/.workbuddy/skills/方法论-{名称}/{references,examples}
# 如有模板/脚本需求,再创建:
mkdir -p ~/.workbuddy/skills/方法论-{名称}/{templates,scripts}

5.2 逐一创建文件(每个文件都要有实质内容)

文件1:SKILL.md(方法论主文档)

  • YAML frontmatter:name(hyphen-case)、description(含触发词)、agent_created: true
  • 开头必须包含 > ⚠️ 前置条件 区块(见 references/蒸馏框架.md 第4.3节)
  • 方法论名称、适用场景、核心原理、操作步骤、常见误区、适用边界
  • 照着这个文件就能直接执行,不需要看其他文件

文件2:references/原始内容存档.md

  • 去噪后的原始内容完整存档
  • 包含来源链接、作者信息、获取时间
  • 保留方法论相关的所有上下文

文件3:references/理论原理.md

  • 方法论为什么有效的深度解释
  • 引用相关理论(心理学/经济学/管理学等)
  • 不只是说「有效」,要说清「为什么有效」

文件4:references/相关方法论对照.md

  • 至少对比2个同类方法论
  • 对比维度:操作复杂度、适用场景、效果差异、学习成本
  • 输出对比表格

文件5:references/局限性分析.md ⭐ 新增,重要

  • 失效场景:至少写2个这个方法论会失效的场景
  • 盲区:这个方法论的隐含假设是什么
  • 反对观点:原作者自己提到的局限 + 评论区/弹幕里的质疑(Step 2 第4步收集的内容必须写入这里)
  • 前置依赖:用这个方法论之前必须先具备什么
  • 写作规范见 references/蒸馏框架.md 第4.5节

文件6:examples/实例-01-成功.md

  • 完整成功案例:前置状态→输入→操作过程(按步骤)→结果(含数据)→复盘
  • 必须有具体数字/效果,不能泛泛而谈
  • 写作规范见 references/蒸馏框架.md 第4.4节

文件7:examples/实例-02-成功.md

  • 第二个成功案例,来自不同场景
  • 展示方法论的跨场景适用性

文件8:examples/实例-03-失败.md

  • 失败案例:错误场景→错误操作→失败结果→错误分析→教训
  • 帮助理解适用边界。

文件9:examples/实例-04-边界.md ⭐ 新增,重要

  • 边界案例:做到哪一步时意识到这个方法不适用,中途切换
  • 教会用户在「做事的过程中」感知到边界,而不是事后复盘才知道
  • 写作规范见 references/蒸馏框架.md 第4.4节。

文件10+(可选):templates/模板-01.mdtemplates/检查清单.md

  • 如果方法论涉及固定格式输出,提供可直接复用的模板
  • 如果方法论有多个检查点,提供 checklist。

5.3 技能命名规则

  • 目录名:方法论-{简短中文名},如 方法论-选题三问法方法论-批处理工作法
  • YAML name 字段:methodology-{english-name}(hyphen-case),如 methodology-topic-three-questions
  • description 必须包含触发词。

Step 6:更新方法论索引

每创建一个新方法论技能包,同步更新 references/方法论索引.md

| 技能名 | 分类代码 | 适用场景 | 创建日期 | 来源 | 文件数 |
|---------|---------|---------|---------|------|--------|
| 方法论-选题三问法 | CC | 内容选题 | 2026-06-20 | 蒸馏自XXX | 9 |

Step 7:质量检查

创建完成后,逐项检查体系化完整性(见 references/蒸馏框架.md 第五章):

  • SKILL.md 可独立执行,不需要看其他文件
  • SKILL.md 开头有 > ⚠️ 前置条件 区块
  • references/ 至少4个文件(原始存档+理论原理+对照分析+局限性分析)
  • examples/ 至少4个文件(2成功+1失败+1边界)
  • 成功实例包含具体数据/效果
  • 失败实例和边界实例帮助理解边界
  • 局限性分析包含反对观点(来自评论区/弹幕)
  • 原始内容已存档可追溯

三、输入处理策略

场景 A:用户给链接

用户:帮我蒸馏这个 https://www.xiaohongshu.com/explore/xxx

AI 操作流程:
1. 调用「链接内容提取」技能,传入链接
2. 获取:标题、文案、视频(如有)、标签
3. 进入 Step 2 内容预处理(含搜索评论区)
4. 进入 Step 3 蒸馏

场景 B:用户给视频文件

用户:帮我蒸馏这个视频 /path/to/video.mp4

AI 操作流程:
1. 调用「视频文案提取」技能,转录视频文案
2. 得到 .txt 文案文件
3. 读取文案,进入 Step 2

场景 C:用户直接给文案

用户:帮我蒸馏这个方法论:【粘贴大段文字】

AI 操作流程:
1. 直接使用用户提供的文案
2. 进入 Step 2 内容预处理
3. 进入 Step 3 蒸馏

场景 D:用户给电子书文件

用户:帮我把这本书 /path/to/book.pdf 拆解成技能
     或:把这本《原子习惯》(epub)变成行动技能包

AI 操作流程:
1. 识别文件格式(pdf/epub/txt/md)
2. 运行对应的提取脚本或直接读取
3. 执行书籍结构分析(Step 0 路径E.2)
4. 展示分析报告,让用户选择输出模式 A/B/C
5. 根据用户选择生成技能包并安装

场景 E(原场景D):用户给公众号文章链接

用户:帮我从这篇文章提取方法论 https://mp.weixin.qq.com/s/xxx

AI 操作流程:
1. 用 WebFetch 工具抓取文章内容
2. 得到完整 Markdown 正文
3. 进入 Step 2

四、蒸馏质量检查清单

在输出蒸馏结果前,逐项检查:

  • 方法论是否可以在不回看原文的情况下独立使用?
  • 操作步骤是否具体到「照着做」的程度?
  • 是否包含了「为什么有效」的原理说明?
  • 是否标注了适用边界(什么时候用/什么时候不用)?
  • 是否去除了原作者的个人故事和无关案例(保留作为示例除外)?
  • 如果原内容有矛盾或不完整,是否标注了「待验证」?
  • 是否主动收集了反对观点并写入局限性分析? ← 新增,重要

封装技能包时额外检查

  • references/ 目录至少4个文件(含局限性分析.md)?
  • examples/ 目录至少4个文件(2成功+1失败+1边界)?
  • SKILL.md 开头有前置条件区块?
  • 成功实例有具体数据?
  • 失败实例和边界实例有错误分析?
  • 局限性分析包含评论区/弹幕的反对观点?

五、与现有技能的关系

现有技能与本技能的关系
链接内容提取上游 — 提供原始内容
视频文案提取上游 — 提供视频文案
skill-creator下游 — 创建方法论技能包的底层工具
知识产品化探测器平行 — 探测可产品化信号,本技能执行蒸馏
对话内容资产挖掘平行 — 从对话挖掘,本技能从外部内容蒸馏
自媒体方法论下游归档 — 蒸馏出的自媒体相关方法论同步更新到此技能

六、与 book-to-skills 的合并说明

本技能 v2.0 已合并原 book-to-skills 的全部功能:

  • 新增:PDF/EPUB/TXT/MD 电子书文本提取(scripts/extract_pdf.py、extract_epub.py)
  • 新增:书籍结构分析(章节拆解、核心概念提取、方法论识别)
  • 新增:三种输出模式(知识库式 / 行动指南式 / 混合式)
  • 新增:批量技能包生成(一本书 → 多个 skill)
  • 保留:五层蒸馏模型、体系化技能包结构、局限性分析规范

book-to-skills skill 已不再需要,所有电子书处理走「技能造物主」统一入口。


八、电子书拆解完整示例

输入:电子书 ~/Desktop/原子习惯.epub

Step 0:识别格式为 EPUB → 路径 E
Step E.1:运行 scripts/extract_epub.py → 得到 22 万字符纯文本
Step E.2:书籍分析 →
    📖 元信息:Atomic Habits / James Clear / 习惯养成 / 微小改变累积大结果
    📑 章节结构:20章,4大定律体系
    🧠 核心概念:习惯四步循环、1%进步法则、身份认同驱动习惯、环境设计、习惯堆叠...
    🔧 方法论:习惯堆叠法(2步)、环境设计法(4步)、两分钟规则(1步)、诱惑捆绑(2步)...
    💡 知识产品化信号:习惯养成系列课程、星球帖「习惯堆叠实操」、公众号「1%进步法则」
    🎯 建议生成 7 个 skill:1知识库 + 6行动指南

Step E.3:用户选择模式 C(混合式)

Step E.4:生成 7 个技能包:
    ~/.workbuddy/skills/atomic-habits-knowledge/     ← 知识库(全书概念+金句+章节)
    ~/.workbuddy/skills/atomic-habits-stacking/      ← 行动指南(习惯堆叠法)
    ~/.workbuddy/skills/atomic-habits-environment/   ← 行动指南(环境设计法)
    ~/.workbuddy/skills/atomic-habits-2min-rule/     ← 行动指南(两分钟规则)
    ~/.workbuddy/skills/atomic-habits-identity/      ← 行动指南(身份认同法)
    ~/.workbuddy/skills/atomic-habits-tracking/      ← 行动指南(习惯追踪法)
    ~/.workbuddy/skills/atomic-habits-bundling/      ← 行动指南(诱惑捆绑法)

Step E.5:全部安装到本地 + 生成 技能索引.md

输出:向用户展示分析报告 + 技能索引 + 触发词说明

输入:小红书链接 https://www.xiaohongshu.com/explore/xxx
     标题:「我是怎么做到日更3条内容还不累的」

Step 1:「链接内容提取」→ 得到文案正文
Step 2:预处理 → 标记【方法】批处理、【技巧】模板库、【心法】80分主义
        → 搜索评论区 → 发现有人质疑「批处理会降低质量」
        → 记录为局限性分析的素材
Step 3:蒸馏 → 得到「内容批处理工作法」
        前置条件:需要已经有内容模板库,否则第一次还是要从头做
        适用场景:需要高频产出的自媒体人
        核心原理:把内容生产从「每次从头做」变成「批量决策+批量执行」
        操作步骤:1. 每周一次性定选题 2. 一次性拍/剪所有视频 3. 统一写文案 4. 统一发布
        局限性预览:质量敏感型内容不适合批处理;新手没有模板库时批处理反而更慢
Step 4:决策 → 完整SOP,≥3步,跨场景可复用 → 创建体系化技能包
Step 5:创建完整技能包(9个文件):
        ~/.workbuddy/skills/方法论-内容批处理法/
        ├── SKILL.md                        ← 方法论主文档(含前置条件区块)
        ├── references/
        │   ├── 原始内容存档.md             ← 小红书原文存档
        │   ├── 理论原理.md                 ← 批处理理论+认知负荷理论
        │   ├── 相关方法论对照.md           ← vs 番茄工作法 vs 看板法
        │   └── 局限性分析.md               ← 失效场景+盲区+评论区反对观点 ← 新增
        ├── examples/
        │   ├── 实例-01-成功.md              ← 桂皮AI实战号日更3条的实操记录
        │   ├── 实例-02-成功.md              ← 创业笔记号周更2条的实操记录
        │   ├── 实例-03-失败.md              ← 没做选题批量决策导致日更失败
        │   └── 实例-04-边界.md              ← 做深度长文时发现不适用,切换为单篇精细生产 ← 新增
        └── templates/
            └── 选题批量决策表.md            ← 可直接复用的选题表模板
Step 6:更新方法论索引
Step 7:质量检查 → 9个文件全部有实质内容,局限性分析含评论区观点 ✅

输出:向用户展示蒸馏结果 + 技能包目录树 + 触发词说明

📝 版本迭代记录

版本日期更新内容摘要操作人
v1.02026-06-20创建技能,定义五层蒸馏模型和完整工作流Kyle
v1.12026-06-20升级为体系化技能包:新增目录结构规范(references+examples+templates)、最佳实例写作规范、反面案例规范、质量检查升级Kyle
v1.22026-06-20体系化结构优化:①新增 references/局限性分析.md(失效场景+盲区+反对观点)②examples/改名(成功/失败/边界)③SKILL.md强制前置条件区块 ④Step 2新增主动收集反对观点 ⑤实例命名统一为「实例-{序号}-{类型}.md」Kyle
v2.02026-06-22🔥 合并 book-to-skills:①新增电子书输入源(PDF/EPUB/TXT/MD)②新增书籍结构分析流程 ③新增三种输出模式(知识库/行动指南/混合)④新增 extract_pdf.py 和 extract_epub.py 脚本 ⑤新增电子书拆解完整示例 ⑥更名为「技能造物主」Kyle

Related skills

把一本书里沉淀的方法论蒸馏成一组原子化、可被Agent调用的skills,同时产出给人看的笔记和话术库。触发:用户说'帮我拆《XX》''把XX蒸馏成skill''distill this book into skills'时。不做书摘/读后感/作者人设角色扮演。

14 installs1 stars

复刻蒸馏写作技能 —— 分析一位作者的多篇文章,深度还原其思维方式与写作风格,生成专属写作分身子技能与风格提示词。支持公众号、抖音多平台自动采集素材,也可手动粘贴文章或指定文件路径。触发词:蒸馏写作风格、写作分身、克隆写作风格、复刻蒸馏写作技能。

抖音复刻蒸馏写作 —— 分析一位作者的多篇文章,深度还原其思维方式与写作风格,生成专属写作分身子技能与风格提示词。支持抖音平台自动采集素材,也可手动粘贴文章或指定文件路径。触发词:蒸馏写作风格、写作分身、克隆写作风格、复刻蒸馏写作技能。

1 stars

公众号复刻蒸馏写作技能 —— 分析一位作者的多篇文章,深度还原其思维方式与写作风格,生成专属写作分身子技能与风格提示词。支持公众号平台自动采集素材,也可手动粘贴文章或指定文件路径。触发词:蒸馏写作风格、写作分身、克隆写作风格、复刻蒸馏写作技能。

公众号投资博主蒸馏器。通过公众号文章数据,自动提取交易体系、市场判断、表达风格、内容深度、互动特征、热点图谱、 人设基因七维DNA,输出结构化风格画像 profile。 触发词:蒸馏投资博主、蒸馏大V、蒸馏公众号大V、分析投资博主风格、 提取交易体系、风格画像、投资博主蒸馏。

1 installs

跨模型蒸馏工程化的第一环:从 WorkBuddy 内部教师技能的 SKILL.md(或任意技能正文) 中结构化提取能力签名——工作流步骤、触发场景、已知限制/坑、工具脚本、以及可被 蒸馏的决策规则(if/when-then/必须)。输出 JSON 能力画像,直接喂给 model-distillation 的签名合成与对抗验证。纯标准库、零依赖、可本地实跑(--selftest 自带样例)。