📐 詹明明·口播稿写作 ——口播稿协作写作技能(知识付费口播为主形态)。三类脚本选型 + 从内容单元装配 + 逐段共创,不一键成稿。 触发方式:/zmm-script、/写口播、/写稿、/zmm-写稿、「写个口播稿」「帮我把这个题写出来」「知识付费口播」「写条视频文案」 Collaborative koubo (talking-head) script writing: script-type selection, unit assembly, section-by-section co-writing. Trigger: /zmm-script, "write a talking-head script", "turn this topic into a video script" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。
Design & media
詹明明·口播剪辑
Try it📐 詹明明·口播剪辑 ——口播成片剪辑技能。把拍好的素材剪成可发布的成片:**按文案规则做内容层重组**(删废镜头/去重复/重排顺序)→ 语音剪辑(去口癖/停顿)→ 加速 → 字幕 → B-roll → 交付。 🔴 **只删和重排,不加词** —— 说话人没说过的话一个字都不加。 詹明明账号的默认参数已固化(抖音 · 保持原长 · 1.15× · HarmonyOS Sans 粗体字幕 · 黄色 #FFE20A 高亮),**不需要每次重说**;换账号只改 §一 那张表,正文流程不变。 检测不到 ChatCut 会引导安装,并给出**本机转写旁路** —— 内容层的活全部不需要 ChatCut。 触发方式:/zmm-cut、/剪辑、/剪片、/zmm-剪、「把这条剪出来」「素材剪成成片」「去口癖」「加字幕」「这条视频剪一下」「重新排一下顺序」 Talking-head footage → publishable cut. Restructures content by copy rules (delete/reorder only, never add words), then cleans speech, speeds up, captions, B-roll. Falls back to local transcription when ChatCut is unavailable. Trigger: /zmm-cut, "cut this footage", "clean up the fillers", "add captions", "reorder this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。
What it does
📐 詹明明·口播剪辑 ——口播成片剪辑技能。把拍好的素材剪成可发布的成片:**按文案规则做内容层重组**(删废镜头/去重复/重排顺序)→ 语音剪辑(去口癖/停顿)→ 加速 → 字幕 → B-roll → 交付。 🔴 **只删和重排,不加词** —— 说话人没说过的话一个字都不加。 詹明明账号的默认参数已固化(抖音 · 保持原长 · 1.15× · HarmonyOS Sans 粗体字幕 · 黄色 #FFE20A 高亮),**不需要每次重说**;换账号只改 §一 那张表,正文流程不变。 检测不到 ChatCut 会引导安装,并给出**本机转写旁路** —— 内容层的活全部不需要 ChatCut。 触发方式:/zmm-cut、/剪辑、/剪片、/zmm-剪、「把这条剪出来」「素材剪成成片」「去口癖」「加字幕」「这条视频剪一下」「重新排一下顺序」 Talking-head footage → publishable cut. Restructures content by copy rules (delete/reorder only, never add words), then cleans speech, speeds up, captions, B-roll. Falls back to local transcription when ChatCut is unavailable. Trigger: /zmm-cut, "cut this footage", "clean up the fillers", "add captions", "reorder this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。
The skill document
zmm-cut:口播成片剪辑
它管的是「拍完之后」。 拍之前的选题、写稿、审核归
/zmm-topic/zmm-script/zmm-review。 本技能不改文案 —— 稿子在拍摄时就定稿了,这里只处理他实际说出来的那一版。
〇、启动顺序(不要跳)
- 🔴 ChatCut 强制前置:本会话第一次调用任何 ChatCut 工具之前,
必须先
Skill{"skill":"chatcut:chatcut-plugin-basics-claude"}并等它加载完。 不要和 ChatCut 工具调用打包在同一轮。 Skill{"skill":"chatcut:talking-head-guide"}—— 口播剪辑的执行规范- 读
zmm/references/家族公约.md(读不到 → 明说「公约读不到,红线无法保证」并停下)zmm/references/交互规范.md(🔴 不是读一遍就算:收尾按 §四 三件套 —— Recap · Before/After · 下一步给编号选项;缺信息按 §四 用选择题问,一次只问一个;不适用的情况见 §五)
- 读
{vault}/00-规则与索引/口播拍摄基线.md(时间/地点/穿着一次定死) - 读记忆
{vault}/08-技能记忆/zmm-cut/+_通用/ - 🔴 剪完之后必须回到
口播稿输出格式.md§四之下「上传版」 —— 见本文 §五
⚠️ 按需读,不要一次读完。 本技能只在「拍完 → 成片」这一段, 不需要读选题层和写稿层的文件。
一、账号默认参数(🔴 已固化,不要再问用户)
🟢 詹明明 2026-08-27 定。这些是默认值,不是每次都要确认的问题。 用户没有说要改,就直接用;用户说了别的,以用户当次说的为准。
| 项 | 默认值 |
|---|---|
| 平台 | 抖音(竖屏 9:16) |
| 成片时长 | 保持原长 —— 不为了短而砍内容(F1:判据是绝对观看时长不是完播率) |
| 整体速度 | 🔴 1.15×(在语音剪辑之后统一加速,不是逐段调) |
| 默认处理 | ① 语音剪辑(去口癖、停顿、重复)② 字幕 |
| 默认不做 | B-roll · MG 动画 · 背景音乐 —— 用户明确要才做 |
| 节奏风格 | 紧凑有力 |
字幕规格(🔴 已固化)
| 项 | 值 |
|---|---|
| 字体 | HarmonyOS Sans 粗体 |
| 描边 | 轻微 |
| 阴影 | 有,轻 |
| 整体观感 | 干净现代 |
| 高亮 | ★ 有,颜色 黄色 #FFE20A |
| 🔴 高亮关键词谁选 | 用户自己选。 出稿时给候选,不要替他定 |
二、工作流(五步,每步之间必须停)
🔴
talking-head-guide硬规则:多个处理之间有依赖,必须按顺序定稿,且每一大步之后单独跟用户确认,不许把多个 checkpoint 打包成一条回复。 上游改了,下游全部要重做(字幕对着加速前的时间轴写 = 全废)。
① 素材进项目 → 停,确认转录出来了
② 语音剪辑 → 停,确认「他实际说的」这一版对不对
③ 整体加速 1.15× → 停,确认节奏
④ 字幕 + 高亮 → 停,让用户选高亮关键词
⑤ 交付 → 只有用户明确说要导出/下载才导
① 素材进项目
- 先
list_projects/create_project/target_project定下项目,再做别的 - 项目一建好立刻把编辑器亮出来(
preview_start),让用户能看着进度 - 素材有三条路进来:用户在编辑器里直接传 · 会话里给了本地路径(走
asset-import)· 用户已经传好了(先browse_assets找,不要上来就说找不到) - 等转录出来就可以开工,不用等原始字节传完(A-roll 只要文字稿)
② 语音剪辑(本技能的主战场)
严格按 talking-head-guide 的 A-roll 流程:
read_script→ 读一遍timeline.md,看清结构- 先跑机械清理(
clean_script):只处理固定口癖(呃/额/嗯)和长停顿 - 🔴 跑完必须重读刷新后的
timeline.md—— 之前读的已经过期 - 再做语义判断:选最好的那一遍、清假开头、删重复和失败的尝试、保留有用的铺垫和上下文
apply_script落到时间轴- 读回来检查:逻辑断没断、上下文丢没丢、删过头没有、停顿是不是太紧
🔴 这个账号特有的三条,别按通用规则剪掉
| 保留 | 为什么 |
|---|---|
| 口语噪声(呢 / 啊 / 哈 / 叠词 / 口误式重复) | 规则 D8:每一句都工整 = 观众一秒听出在念稿。⚠️ 通用的「去口癖」会把这些一起清掉 —— 每 5–8 行留一处是设计好的,不是失误 |
| 邀请自查的插入句(「你仔细想想」「不知道你们有没有这种时候」) | 规则 D15:它带一个动作指令,不是填充词 |
| 限定词(多半 / 很多时候 / 可能才是) | 规则 D4:不许改成绝对化 |
🔴 判据:这个词删掉之后,这句话是变干净了,还是变得像稿子了?变得像稿子 = 别删。
停顿口径
- 明显长停顿(>0.8–1s)→ 压到约 0.3s
- 句子之间保留 0.3–0.5s —— 别压没了
- 转折、对比、强调处的停顿要留住,那是设计好的(稿子里标了 ⏸⏸ 的地方)
- 句内正常呼吸 → 不动
③ 整体加速 1.15×
🔴 必须在语音剪辑定稿之后做,顺序反了字幕全部要重来。 统一加速,不是逐段调速 —— 逐段调会让语调忽快忽慢。
④ 字幕 + 高亮
按 talking-head-guide 的 captions 规范,套 §一 的固化规格。
🔴 高亮关键词不许我替他定。 做法:
- 通读字幕,挑出每 8–12 秒一个的候选关键词(挑判断句、数字、转折词、落点句里的核心词)
- 列出来给用户选,标清在第几秒、原句是什么
- 用户勾完再上高亮
⚠️ 不要整句高亮 —— 高亮的作用是让眼睛在滑动中停一下,整句高亮等于没高亮。
⑤ 交付
🔴 默认交付的是「可编辑的 ChatCut 时间轴」,不是 MP4。
只有用户明确说导出 / 渲染 / 下载 / 最终交付才走 submit_export → track_export。
「剪一下」「清理一下」「做个版本」都不算导出意图。
三、红线(剪辑环节独有)
| 规则 | |
|---|---|
| 不改内容 | 稿子拍摄时已定稿。剪辑只删不加,不许替他补话、顺句子、改语序 |
| 画面信息点 | F3:穿搭 / 桌搭 / 背景 / 墙上装饰都是信息点。剪的时候别把有信息的画面剪掉 |
| 不上 AI 截图 | 讲 AI 那一段的画面不要配 AI 界面截图 —— 会把人群窄掉(不要变成工具号) |
| 打大字的位置 | 稿子的「需要处理的点」里标了 ⏸ 打大字的行,剪辑时要对上 |
| 金额打码 | 任何出现后台数据/收款/客户信息的画面一律打码 |
四、说给谁听
单人自采自编。 拍摄、剪辑、发布都是他一个人:
- 方案要能一个人执行完,不假设有剪辑师
- 直接给判断和动作,不写「供参考」
- 零术语:不说「A-roll」,说「他说话那条主轨」;不说「ripple」,说「后面的会跟着往前挪」
五、🔴 剪完必须回填(这一步最容易漏)
成片发出去之后,把实际播出的文字稿转录回来,写进稿件的「上传版」那一节。
规范见 {vault}/00-规则与索引/口播稿输出格式.md §四之下「上传版」。
三块,缺一不可:
- 上传版全文(代码块 + 行号 + 气口)—— 🔴 只改 ASR 听错的专名和错别字,不改语序、不补顺句子
- 差异表(文案版 vs 他实际说的)—— 类型只用五个:加 / 删 / 改措辞 / 换结构 / 调顺序
- 从差异提炼的规则 → 入库
🔴 为什么不能省:稿子是写的,播出版是他说的。 两者之间每一处差异,都是他用嘴投出来的一票 —— 那是这个系统里最诚实的反馈。
⚠️ D2b:差异表里「改措辞」那一栏不适用「默认他的更好」——
口述比写作更容易临场钝化。凡 AI 版更锋利的,单独标出来问。
六、绝对不做
- 不在没加载
chatcut-plugin-basics-claude的情况下调 ChatCut 工具 - 不把多个 checkpoint 打包成一条回复
- 不自作主张加背景音乐 / B-roll / MG / 转场 —— 用户没要就不做
- 不替用户选高亮关键词
- 不用本地 ffmpeg 压一个拍平的 MP4 当主交付物(ffmpeg 只用于只读检查源文件)
- 不因为「剪一下」就去导出
七、记忆
结束前自查:
- 用户否了哪种剪法(记「纠正」,例:「口语噪声不许清」)?
- 哪个参数被实测验证有效(记「有效方法」,带数值)?
写入 {vault}/08-技能记忆/zmm-cut/,先查重。
不知道下一步 → 回 /zmm。
Related skills
📐 詹明明·哪里会被划走 ——口播稿「划走点」专项。替观众把稿子听一遍:每一拍观众手里有什么、在等什么,断在哪一拍 —— 等的没来、手里有了还在给、正在给的听不清。诊断完默认主动问是否标记式改稿。 触发方式:/zmm-flow、/会不会划走、/顺稿、/zmm-顺稿、「这稿子顺不顺」「哪里会划走」「逻辑有没有断」「读起来卡不卡」「完播会不会掉」 Drop-off check for talking-head scripts: walk the script as a listener, beat by beat — what the viewer holds, what they are waiting for, and where that chain breaks. Trigger: /zmm-flow, "does this script flow", "where will viewers drop off", "check retention risk" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。
把口播视频去废话精剪需求变成可执行工作流、可运行代码与可交付内容
编排 ChatCut 官方能力,稳妥完成口播样片、整片扩展与验证
📐 詹明明 ——两套技能的总入口:做内容(选题/写稿/审核/复盘)+ 看生意(组合体检/营收归因/客户集中度/依赖风险/拿不准的决策)。三种模式:新手上路演示、任务前路由、任务后导航。不知道用哪个就回这里。 触发方式:/zmm、/新手上路、/zmm 教程、「做条视频」「出个口播」「今天拍什么」「内容下一步怎么走」;新手教程:/zmm 新手指南、/zmm 新手、「这个怎么用」「第一次用,带我走一遍」「不知道能干嘛」 Single entry point for both skill sets — content (topic, script, review, retro) and business (portfolio, revenue, concentration, dependency, decisions). Three modes: guided onboarding demo, pre-task routing, post-task navigation. Trigger: /zmm, "make a short video", "what should I shoot today", "how do I use this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。
📐 詹明明·发布前审一遍 ——口播稿发布前审核技能。按观众的四次决定审:点不点进来 · 留不留下来 · 记不记得你 · 做不做点什么。逐句信息密度评分(60/80 分线)+ 十一问 + 红线五查(改法给稳妥版和保留力度版两版)+ 机器信号层(导流 / 广告形状 / 名单词,与内容违规分开报),默认只诊断不改。 触发方式:/zmm-review、/能不能发、/审核、/zmm-审核、「这稿子能不能发」「帮我审一下」「过一遍红线」「信息密度够不够」 Pre-publish review for talking-head scripts, organised around the viewer's four decisions: click, stay, remember, act. Per-sentence density scoring, eleven questions, red-line audit. Diagnose-only by default. Trigger: /zmm-review, "can I publish this", "review my script" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。