设计与多媒体

詹明明·口播剪辑

试用

📐 詹明明·口播剪辑 ——口播成片剪辑技能。把拍好的素材剪成可发布的成片:**按文案规则做内容层重组**(删废镜头/去重复/重排顺序)→ 语音剪辑(去口癖/停顿)→ 加速 → 字幕 → B-roll → 交付。 🔴 **只删和重排,不加词** —— 说话人没说过的话一个字都不加。 詹明明账号的默认参数已固化(抖音 · 保持原长 · 1.15× · HarmonyOS Sans 粗体字幕 · 黄色 #FFE20A 高亮),**不需要每次重说**;换账号只改 §一 那张表,正文流程不变。 检测不到 ChatCut 会引导安装,并给出**本机转写旁路** —— 内容层的活全部不需要 ChatCut。 触发方式:/zmm-cut、/剪辑、/剪片、/zmm-剪、「把这条剪出来」「素材剪成成片」「去口癖」「加字幕」「这条视频剪一下」「重新排一下顺序」 Talking-head footage → publishable cut. Restructures content by copy rules (delete/reorder only, never add words), then cleans speech, speeds up, captions, B-roll. Falls back to local transcription when ChatCut is unavailable. Trigger: /zmm-cut, "cut this footage", "clean up the fillers", "add captions", "reorder this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。

它能做什么

📐 詹明明·口播剪辑 ——口播成片剪辑技能。把拍好的素材剪成可发布的成片:**按文案规则做内容层重组**(删废镜头/去重复/重排顺序)→ 语音剪辑(去口癖/停顿)→ 加速 → 字幕 → B-roll → 交付。 🔴 **只删和重排,不加词** —— 说话人没说过的话一个字都不加。 詹明明账号的默认参数已固化(抖音 · 保持原长 · 1.15× · HarmonyOS Sans 粗体字幕 · 黄色 #FFE20A 高亮),**不需要每次重说**;换账号只改 §一 那张表,正文流程不变。 检测不到 ChatCut 会引导安装,并给出**本机转写旁路** —— 内容层的活全部不需要 ChatCut。 触发方式:/zmm-cut、/剪辑、/剪片、/zmm-剪、「把这条剪出来」「素材剪成成片」「去口癖」「加字幕」「这条视频剪一下」「重新排一下顺序」 Talking-head footage → publishable cut. Restructures content by copy rules (delete/reorder only, never add words), then cleans speech, speeds up, captions, B-roll. Falls back to local transcription when ChatCut is unavailable. Trigger: /zmm-cut, "cut this footage", "clean up the fillers", "add captions", "reorder this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。

技能文档

zmm-cut:口播成片剪辑

它管的是「拍完之后」。 拍之前的选题、写稿、审核归 /zmm-topic /zmm-script /zmm-review本技能不改文案 —— 稿子在拍摄时就定稿了,这里只处理他实际说出来的那一版

〇、启动顺序(不要跳)

  1. 🔴 ChatCut 强制前置:本会话第一次调用任何 ChatCut 工具之前, 必须先 Skill{"skill":"chatcut:chatcut-plugin-basics-claude"} 并等它加载完。 不要和 ChatCut 工具调用打包在同一轮。
  2. Skill{"skill":"chatcut:talking-head-guide"} —— 口播剪辑的执行规范
  3. zmm/references/家族公约.md(读不到 → 明说「公约读不到,红线无法保证」并停下)
    • zmm/references/交互规范.md(🔴 不是读一遍就算:收尾按 §四 三件套 —— Recap · Before/After · 下一步给编号选项;缺信息按 §四 用选择题问,一次只问一个;不适用的情况见 §五)
  4. {vault}/00-规则与索引/口播拍摄基线.md(时间/地点/穿着一次定死)
  5. 读记忆 {vault}/08-技能记忆/zmm-cut/ + _通用/
  6. 🔴 剪完之后必须回到 口播稿输出格式.md §四之下「上传版」 —— 见本文 §五

⚠️ 按需读,不要一次读完。 本技能只在「拍完 → 成片」这一段, 不需要读选题层和写稿层的文件。


一、账号默认参数(🔴 已固化,不要再问用户)

🟢 詹明明 2026-08-27 定。这些是默认值,不是每次都要确认的问题。 用户没有说要改,就直接用;用户说了别的,以用户当次说的为准。

默认值
平台抖音(竖屏 9:16)
成片时长保持原长 —— 不为了短而砍内容(F1:判据是绝对观看时长不是完播率)
整体速度🔴 1.15×(在语音剪辑之后统一加速,不是逐段调)
默认处理语音剪辑(去口癖、停顿、重复)② 字幕
默认不做B-roll · MG 动画 · 背景音乐 —— 用户明确要才做
节奏风格紧凑有力

字幕规格(🔴 已固化)

字体HarmonyOS Sans 粗体
描边轻微
阴影有,轻
整体观感干净现代
高亮,颜色 黄色 #FFE20A
🔴 高亮关键词谁选用户自己选。 出稿时给候选,不要替他定

二、工作流(五步,每步之间必须停)

🔴 talking-head-guide 硬规则:多个处理之间有依赖,必须按顺序定稿,且每一大步之后单独跟用户确认,不许把多个 checkpoint 打包成一条回复。 上游改了,下游全部要重做(字幕对着加速前的时间轴写 = 全废)。

① 素材进项目   → 停,确认转录出来了
② 语音剪辑     → 停,确认「他实际说的」这一版对不对
③ 整体加速 1.15× → 停,确认节奏
④ 字幕 + 高亮   → 停,让用户选高亮关键词
⑤ 交付         → 只有用户明确说要导出/下载才导

① 素材进项目

  • list_projects / create_project / target_project 定下项目,再做别的
  • 项目一建好立刻把编辑器亮出来(preview_start),让用户能看着进度
  • 素材有三条路进来:用户在编辑器里直接传 · 会话里给了本地路径(走 asset-import)· 用户已经传好了(先 browse_assets 找,不要上来就说找不到
  • 等转录出来就可以开工,不用等原始字节传完(A-roll 只要文字稿)

② 语音剪辑(本技能的主战场)

严格按 talking-head-guide 的 A-roll 流程:

  1. read_script → 读一遍 timeline.md,看清结构
  2. 先跑机械清理clean_script):只处理固定口癖(呃/额/嗯)和长停顿
  3. 🔴 跑完必须重读刷新后的 timeline.md —— 之前读的已经过期
  4. 再做语义判断:选最好的那一遍、清假开头、删重复和失败的尝试、保留有用的铺垫和上下文
  5. apply_script 落到时间轴
  6. 读回来检查:逻辑断没断、上下文丢没丢、删过头没有、停顿是不是太紧

🔴 这个账号特有的三条,别按通用规则剪掉

保留为什么
口语噪声(呢 / 啊 / 哈 / 叠词 / 口误式重复)规则 D8每一句都工整 = 观众一秒听出在念稿。⚠️ 通用的「去口癖」会把这些一起清掉 —— 每 5–8 行留一处是设计好的,不是失误
邀请自查的插入句(「你仔细想想」「不知道你们有没有这种时候」)规则 D15:它带一个动作指令,不是填充词
限定词(多半 / 很多时候 / 可能才是)规则 D4:不许改成绝对化

🔴 判据:这个词删掉之后,这句话是变干净了,还是变得像稿子了?变得像稿子 = 别删。

停顿口径

  • 明显长停顿(>0.8–1s)→ 压到约 0.3s
  • 句子之间保留 0.3–0.5s —— 别压没了
  • 转折、对比、强调处的停顿要留住,那是设计好的(稿子里标了 ⏸⏸ 的地方)
  • 句内正常呼吸 → 不动

③ 整体加速 1.15×

🔴 必须在语音剪辑定稿之后做,顺序反了字幕全部要重来。 统一加速,不是逐段调速 —— 逐段调会让语调忽快忽慢。

④ 字幕 + 高亮

talking-head-guide 的 captions 规范,套 §一 的固化规格。

🔴 高亮关键词不许我替他定。 做法:

  1. 通读字幕,挑出每 8–12 秒一个的候选关键词(挑判断句、数字、转折词、落点句里的核心词)
  2. 列出来给用户选,标清在第几秒、原句是什么
  3. 用户勾完再上高亮

⚠️ 不要整句高亮 —— 高亮的作用是让眼睛在滑动中停一下,整句高亮等于没高亮。

⑤ 交付

🔴 默认交付的是「可编辑的 ChatCut 时间轴」,不是 MP4。 只有用户明确说导出 / 渲染 / 下载 / 最终交付才走 submit_exporttrack_export「剪一下」「清理一下」「做个版本」都不算导出意图。


三、红线(剪辑环节独有)

规则
不改内容稿子拍摄时已定稿。剪辑只删不加,不许替他补话、顺句子、改语序
画面信息点F3:穿搭 / 桌搭 / 背景 / 墙上装饰都是信息点。剪的时候别把有信息的画面剪掉
不上 AI 截图讲 AI 那一段的画面不要配 AI 界面截图 —— 会把人群窄掉(不要变成工具号
打大字的位置稿子的「需要处理的点」里标了 ⏸ 打大字的行,剪辑时要对上
金额打码任何出现后台数据/收款/客户信息的画面一律打码

四、说给谁听

单人自采自编。 拍摄、剪辑、发布都是他一个人:

  • 方案要能一个人执行完,不假设有剪辑师
  • 直接给判断和动作,不写「供参考」
  • 零术语:不说「A-roll」,说「他说话那条主轨」;不说「ripple」,说「后面的会跟着往前挪」

五、🔴 剪完必须回填(这一步最容易漏)

成片发出去之后,把实际播出的文字稿转录回来,写进稿件的「上传版」那一节。 规范见 {vault}/00-规则与索引/口播稿输出格式.md §四之下「上传版」。

三块,缺一不可:

  1. 上传版全文(代码块 + 行号 + 气口)—— 🔴 只改 ASR 听错的专名和错别字,不改语序、不补顺句子
  2. 差异表(文案版 vs 他实际说的)—— 类型只用五个:加 / 删 / 改措辞 / 换结构 / 调顺序
  3. 从差异提炼的规则 → 入库

🔴 为什么不能省:稿子是写的,播出版是他说的。 两者之间每一处差异,都是他用嘴投出来的一票 —— 那是这个系统里最诚实的反馈。

⚠️ D2b:差异表里「改措辞」那一栏不适用「默认他的更好」—— 口述比写作更容易临场钝化。凡 AI 版更锋利的,单独标出来问。


六、绝对不做

  • 不在没加载 chatcut-plugin-basics-claude 的情况下调 ChatCut 工具
  • 不把多个 checkpoint 打包成一条回复
  • 不自作主张加背景音乐 / B-roll / MG / 转场 —— 用户没要就不做
  • 不替用户选高亮关键词
  • 不用本地 ffmpeg 压一个拍平的 MP4 当主交付物(ffmpeg 只用于只读检查源文件)
  • 不因为「剪一下」就去导出

七、记忆

结束前自查:

  • 用户否了哪种剪法(记「纠正」,例:「口语噪声不许清」)?
  • 哪个参数被实测验证有效(记「有效方法」,带数值)?

写入 {vault}/08-技能记忆/zmm-cut/先查重


不知道下一步 → 回 /zmm

相关技能

📐 詹明明·口播稿写作 ——口播稿协作写作技能(知识付费口播为主形态)。三类脚本选型 + 从内容单元装配 + 逐段共创,不一键成稿。 触发方式:/zmm-script、/写口播、/写稿、/zmm-写稿、「写个口播稿」「帮我把这个题写出来」「知识付费口播」「写条视频文案」 Collaborative koubo (talking-head) script writing: script-type selection, unit assembly, section-by-section co-writing. Trigger: /zmm-script, "write a talking-head script", "turn this topic into a video script" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。

📐 詹明明·哪里会被划走 ——口播稿「划走点」专项。替观众把稿子听一遍:每一拍观众手里有什么、在等什么,断在哪一拍 —— 等的没来、手里有了还在给、正在给的听不清。诊断完默认主动问是否标记式改稿。 触发方式:/zmm-flow、/会不会划走、/顺稿、/zmm-顺稿、「这稿子顺不顺」「哪里会划走」「逻辑有没有断」「读起来卡不卡」「完播会不会掉」 Drop-off check for talking-head scripts: walk the script as a listener, beat by beat — what the viewer holds, what they are waiting for, and where that chain breaks. Trigger: /zmm-flow, "does this script flow", "where will viewers drop off", "check retention risk" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。

📐 詹明明 ——两套技能的总入口:做内容(选题/写稿/审核/复盘)+ 看生意(组合体检/营收归因/客户集中度/依赖风险/拿不准的决策)。三种模式:新手上路演示、任务前路由、任务后导航。不知道用哪个就回这里。 触发方式:/zmm、/新手上路、/zmm 教程、「做条视频」「出个口播」「今天拍什么」「内容下一步怎么走」;新手教程:/zmm 新手指南、/zmm 新手、「这个怎么用」「第一次用,带我走一遍」「不知道能干嘛」 Single entry point for both skill sets — content (topic, script, review, retro) and business (portfolio, revenue, concentration, dependency, decisions). Three modes: guided onboarding demo, pre-task routing, post-task navigation. Trigger: /zmm, "make a short video", "what should I shoot today", "how do I use this" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。

📐 詹明明·发布前审一遍 ——口播稿发布前审核技能。按观众的四次决定审:点不点进来 · 留不留下来 · 记不记得你 · 做不做点什么。逐句信息密度评分(60/80 分线)+ 十一问 + 红线五查(改法给稳妥版和保留力度版两版)+ 机器信号层(导流 / 广告形状 / 名单词,与内容违规分开报),默认只诊断不改。 触发方式:/zmm-review、/能不能发、/审核、/zmm-审核、「这稿子能不能发」「帮我审一下」「过一遍红线」「信息密度够不够」 Pre-publish review for talking-head scripts, organised around the viewer's four decisions: click, stay, remember, act. Per-sentence density scoring, eleven questions, red-line audit. Diagnose-only by default. Trigger: /zmm-review, "can I publish this", "review my script" —— 📐 詹明明 · 不给公式,给判据。每条规则都标了实测代价。