Design & media

短视频生成-免费版

Try it

短视频生成免费版,为个人创作者提供从文案到成片的轻量化生产流程。核心能力: - 画面规划(分镜表自动生成) - AI 素材生成(按文案智能匹配) - TTS 配音(单场景配音) - 视频渲染(Remotion + 动画) - 音视频合成输出 MP4 适用场景: - 个人短视频博主快速出片 - 知识科普视频制作 - 社交媒体内容创作 - 简易宣传视频生成 差异化: - 免费版聚焦单视频生成流程,零门槛上手 - 内置常用素材关键词映射表...

What it does

短视频生成免费版,为个人创作者提供从文案到成片的轻量化生产流程。核心能力: - 画面规划(分镜表自动生成) - AI 素材生成(按文案智能匹配) - TTS 配音(单场景配音) - 视频渲染(Remotion + 动画) - 音视频合成输出 MP4 适用场景: - 个人短视频博主快速出片 - 知识科普视频制作 - 社交媒体内容创作 - 简易宣传视频生成 差异化: - 免费版聚焦单视频生成流程,零门槛上手 - 内置常用素材关键词映射表...

The skill document

短视频生成工具 - 免费版

概述

短视频生成免费版是一款面向个人创作者的轻量级视频生产工具。它将「画面规划 → AI 素材生成 → TTS 配音 → 视频渲染 → 音视频合成」整合为一条流水线,用户只需提供主题与口播文案,即可获得完整 MP4 成片. 免费版聚焦核心生产流程:单视频生成、基础动画效果、中文 TTS 配音。配置简单,适合以下用户:

  • 短视频博主快速生产日常内容
  • 知识科普创作者批量产出教学视频
  • 自媒体运营人员制作简易宣传内容
  • 个人用户尝试 AI 视频创作

免费版限制:单次生成 1 个视频,最多 10 个场景,仅支持中文 TTS。如需批量生产、多语言配音、自定义动画模板等能力,请使用 PRO 版本.

核心能力

能力清单

能力描述免费版
画面规划自动生成分镜表支持
AI 素材生成按关键词生成画面素材支持
TTS 配音场景级配音支持(仅中文)
视频渲染Remotion 动画渲染支持
音视频合成输出 MP4支持
场景数量单视频场景上限≤10 个
多语言配音英文/日文等不支持
批量生产多视频并行不支持
自定义模板自定义动画效果不支持
A/B 变体多版本对比不支持
品牌一致性Logo/水印/配色不支持

处理: 解析能力清单的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回能力清单的响应数据,包含状态码、结果和日志.

工作流程

输入格式

参数名类型必填说明
inputstring短视频生成-免费版处理的输入数据或指令
optionsobject附加配置选项,如模式选择、格式偏好等
callback_urlstring异步处理完成后的回调通知URL
用户输入主题 + 口播文案
      ↓
画面规划(生成分镜表 JSON)
      ↓
AI 素材生成(按关键词匹配)
      ↓
TTS 配音(每场景独立配音)
      ↓
视频代码生成(Remotion 组件)
      ↓
渲染 + 合成 MP4
      ↓
输出成片到 out/final.mp4

处理: 解析工作流程的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回工作流程的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

技能协作架构

本技能采用「协调者 + 规划专家」协作模式:

用户输入
   ↓
video-producer-tool-free(协调者)
   ↓
调用画面规划模块(分镜表生成)
   ↓
返回分镜表(JSON 格式)
   ↓
video-producer-tool-free 继续执行
   ↓
AI 生图 → TTS 配音 → 视频渲染 → 合成输出

协作优势:

  • 职责分离:规划模块专注画面设计,执行模块专注渲染
  • 独立使用:规划模块可单独用于画面设计
  • 灵活调整:用户可手动修改分镜表后再生成视频
  • 易于维护:设计规则与执行逻辑分离

处理: 解析技能协作架构的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回技能协作架构的响应数据,包含状态码、结果和日志. 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:轻量短视频一键生、成工具、支持画面规划、配音与视频渲染、适合个人创作者快、速出片、短视频生成免费版、为个人创作者提供、从文案到成片的轻、量化生产流程、核心能力、分镜表自动生成、按文案智能匹配、单场景配音、音视频合成输出等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.

核心功能执行

执行核心功能执行操作,使用input_params参数进行配置.

处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

使用场景

场景 1:知识科普短视频

小张是一名科普博主,想制作一期关于「AI 如何改变工作」的 10 秒短视频. 操作步骤:

  1. 告诉 Agent:「帮我生成一个 10 秒短视频,主题是 AI 改变工作」
  2. 提供口播文案:[{"text":"AI 正在改变我们的工作","emoji":"🤖","title":"AI 时代"}]
  3. Agent 自动完成:分镜表 → AI 素材 → 配音 → 渲染
  4. 输出成片至 /out/final.mp4

示例命令:

node produce.js "AI 改变工作" '[{"text":"AI 正在改变我们的工作","emoji":"🤖","title":"AI 时代"}]'

场景 2:社交媒体宣传视频

小李需要为自己的小店制作一个简易宣传视频. 操作步骤:

  1. 告诉 Agent:「帮我生成一个 15 秒的店铺宣传视频」
  2. 提供文案内容(4-5 个场景)
  3. Agent 生成分镜表,用户确认后继续
  4. 自动生成 AI 素材并配音
  5. 渲染输出 MP4

示例命令:

node produce.js "小店宣传" '[
  {"text":"发现你的专属好物","emoji":"🛍️","title":"精选好店"},
  {"text":"品质保证 价格实惠","emoji":"💰","title":"品质保证"},
  {"text":"立即进店选购","emoji":"🎉","title":"欢迎光临"}
]'

场景 3:教学要点视频

小王想将一段学习笔记转化为视频分享给同学. 操作步骤:

  1. 告诉 Agent:「把这段学习要点做成 20 秒视频」
  2. 提供要点文案(6 个场景,每场景一句口播)
  3. Agent 自动生成分镜与素材
  4. 输出教学短视频

示例命令:

node produce.js "学习要点" '[
  {"text":"第一步 理解基础概念","emoji":"📚","title":"基础概念"},
  {"text":"第二步 掌握核心方法","emoji":"💡","title":"核心方法"},
  {"text":"第三步 实际应用练习","emoji":"✏️","title":"实践练习"}
]'

不适用场景

以下场景短视频生成-免费版不适合处理:

  • 版权受保护的媒体内容处理
  • 实时直播推流
  • 专业影视后期

触发条件

需要视频处理、音频编辑、媒体转换、配音生成时使用。不适用于非本工具能力范围的需求.

快速开始

第一步:环境准备

# 检查 Node.js 版本(需 16+)
node --version
# ...
# 依赖说明
npx remotion --version

第二步:生成第一个视频

最简单的用法 - 单场景视频:

node produce.js "测试视频" '[{"text":"这是一个测试","emoji":"✨","title":"测试"}]'

第三步:多场景视频

生成包含 5 个场景的短视频:

node produce.js "AI 主题" '[
  {"text":"AI 时代已经到来","emoji":"🤖","title":"AI 时代"},
  {"text":"它正在改变各行各业","emoji":"💼","title":"行业变革"},
  {"text":"从编程到设计","emoji":"🎨","title":"创作升级"},
  {"text":"从数据到决策","emoji":"📊","title":"智能决策"},
  {"text":"未来已来 你准备好了吗","emoji":"🚀","title":"未来已来"}
]'

第四步:查看输出

# 输出目录结构
ls -la test-video/

示例

分镜表格式

**总时长:** 10秒
# ...
| 场景 | 时间 | 类型 | 口播 | 素材 |
|---:|---:|---:|---:|---:|
| 0 | 0-2s | 开场 | 主题... | 科技背景 |
| 1 | 2-7s | 核心观点 | 口播... | AI, 工作 |
| 2 | 7-10s | 结尾 | 口播... | 未来科技 |

素材清单格式

| 元素 | 类型 | Prompt | 尺寸 | 保存路径 |
|:---:|:---:|:---:|:---:|:---:|
| 科技背景 | 背景 | 抽象科技背景 | 9:16 | s00_科技背景.png |
| AI | 素材 | AI机器人头像 | 1:1 | s01_AI.png |

关键词映射表

免费版内置常用关键词到素材的映射:

关键词素材描述
AI / 机器人逼真的 AI 机器人头像
数据 / 录入数据流动画
设计 / 创意设计师工作场景
程序员 / 代码编程工作场景
赚钱 / 收入金币增长图表
时间 / 倒计时沙漏时钟
技能 / 升级技能树图标
取代 / 替代人类 vs AI 对比图
裁员空荡办公室
实习生年轻人使用 AI

输出文件结构

test-video/
├── storyboard.md      # 画面设计方案(含素材路径)
├── materials/         # AI 素材
│   ├── s00_科技背景.png
│   ├── s01_AI.png
│   └── ...
├── audio/             # TTS 配音
│   ├── s0.mp3
│   ├── s1.mp3
│   └── ...
├── src/Video.js       # 视频代码
└── out/final.mp4      # 最终视频

最佳实践

1. 文案设计建议

  • 每场景口播控制在 5-15 字
  • 总时长建议 10-30 秒(社交媒体友好)
  • 每场景搭配一个 Emoji 增强表现力
  • 开场场景用「疑问句」吸引注意
  • 结尾场景用「行动号召」收尾

2. 素材关键词使用

// 视频代码自动引用素材路径
import img0_科技背景 from 'materials/s00_科技背景.png';
import img1_AI from 'materials/s01_AI.png';
// ...
// 在场景中使用

3. 分镜表手动调整

生成分镜表后,用户可手动修改再渲染:

# 步骤 1:生成画面设计方案(暂停等待确认)
node produce.js --plan-only "AI 主题" '...'
# ...
# 步骤 2:手动修改 storyboard.md
# ...
# 步骤 3:基于修改后的分镜表继续渲染
node produce.js --from-storyboard test-video/storyboard.md

4. 场景时长建议

视频总时长建议场景数每场景时长
10 秒3-4 个2-3 秒
15 秒4-5 个3 秒
20 秒5-6 个3-4 秒
30 秒6-8 个3-5 秒

常见问题

Q1:生成的视频只有一句配音?

A: 这是已知问题,免费版已内置重试逻辑:

  • TTS 生成最多重试 3 次
  • 自动验证音频文件大小(>1KB)
  • 缺失文件会输出警告提示

如果仍有问题,请检查 TTS 服务可用性.

Q2:AI 素材生成失败怎么办?

A: 可能原因:

  1. AI 生图服务不可用,请稍后重试
  2. 关键词未在映射表中,请使用同义词
  3. 网络问题,检查网络连接

Q3:能否手动修改分镜表后再生成?

A: 可以。先生成分镜表(--plan-only),手动编辑 storyboard.md,再用 --from-storyboard 继续.

Q4:免费版支持哪些语言配音?

A: 免费版仅支持中文 TTS。如需英文、日文等多语言配音,请使用 PRO 版本.

Q5:视频渲染很慢如何优化?

A: 优化建议:

  • 减少场景数量(每场景渲染独立计算)
  • 降低素材分辨率
  • 关闭不必要的动画效果
  • 确保 CPU 资源充足

Q6:输出目录在哪里?

A: 默认输出到 test-video/ 目录,包含 storyboard.mdmaterials/audio/src/out/final.mp4.

依赖说明

运行环境

  • Agent 平台:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统:Windows / macOS / Linux
  • Node.js:16+(Remotion 渲染依赖)
  • 内存:建议 8GB+(渲染高分辨率视频)

第三方依赖

依赖项类型是否必需获取方式版本要求
Node.js运行时必需nodejs.org16+
Remotionnpm 包必需npm install remotion4.0+
FFmpeg命令行工具必需系统包管理器4.0+
AI 生图 APIAPI必需参考 PRO 版本说明-
TTS APIAPI必需参考 PRO 版本说明-
LLM APIAPI必需由 Agent 内置 LLM 提供-

安装命令

# 安装 Node.js 与 Remotion
npm install -g remotion
npm install
# ...
# 验证安装
node --version
npx remotion --version
ffmpeg -version

API Key 配置

免费版需要以下 API Key:

API 类型环境变量用途获取方式
AI 生图IMAGE_GEN_API_KEY生成画面素材对应 AI 生图服务商
TTS 服务TTS_API_KEY场景配音对应 TTS 服务商
# 配置环境变量(示例)
export IMAGE_GEN_API_KEY="your_image_gen_key"
export TTS_API_KEY="your_tts_key"

可用性分类

  • 分类:MD+EXEC(Markdown 指令 + 命令行执行 + Node.js 脚本)
  • 说明:通过自然语言指令驱动 Agent 调用 produce.js 完成短视频生成
  • 离线可用:部分(渲染本地完成,素材生成与配音需网络)
  • 隐私等级:中(文案与素材需上传至 AI 服务)

版本说明

  • 当前版本:1.0.0
  • 版本类型:FREE(免费版)
  • 升级路径:如需批量生产、多语言配音、自定义模板、A/B 变体等能力,请使用 video-producer-tool-pro

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

已知限制

  • 需LLM支持,无LLM环境不可用
  • 复杂业务场景建议结合人工经验判断
  • 执行效率受模型能力与网络环境影响

Related skills

从Markdown脚本一键生成9:16竖版短视频,支持TTS配音、字幕烧录与画面同步,适合个人内容创作者。Use when 需要视频处理、音频编辑、媒体转换、配音生成时使用。不适用于版权受保护的媒体内容处理。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

1 installs

做一条短视频要剪辑2小时?输入一个主题,自动完成文案→素材搜索→语音合成→字幕→BGM→成片输出。抖音/快手/TikTok/YouTube/B站/小红书/视频号全平台适配。批量生产,一天出10条不是梦。支持AI配音、智能配乐、多语言字幕、批量导出,从选题到成片全流程自动化。 触发词:AI视频生成、自动做视频、短视...

5 installs1 stars

做一条短视频要剪辑2小时?输入主题,自动完成文案→素材→配音→字幕→BGM→成片。抖音/快手/B站/YouTube/小红书/视频号全平台适配。批量生产一天出10条。 触发词:AI视频/自动做视频/一键成片/批量视频/视频工厂/帮我做视频/视频自动生成/短视频矩阵/多平台分发 排除:视频剪辑教程/直播推流/长视频(...

5 installs

【2026增强版】基于AI自动生成视频内容。支持文本转视频、图文转视频、脚本自动生成+配音+字幕+剪辑全流程。集成edge-tts配音、ffmpeg自动化剪辑。当用户说"生成视频"、"制作视频"、"自动剪辑"、"批量生产视频"、"AI视频生成"、"做个短视频"时触发此技能。

1 installs

从文本/资料/口播脚本一站式生成可交付的视频 MP4。流程:planner 阶段产出脚本+分镜+素材清单+TTS 配置 → hyperframes 阶段自动 init 项目、生成 HTML composition、合成 TTS 音频、渲染 MP4。适用于产品讲解、口播视频、概念解释、教育科普等场景。

短视频/中长视频创作全能助手。覆盖脚本撰写、分镜设计、文案润色、 配音脚本、字幕生成、封面设计、平台适配(抖音/小红书/B站/视频号)、 爆款选题策划、热门话题追踪、数据分析指导。 支持口播类/剧情类/干货类/测评类/Vlog等主流视频类型。 触发词:视频脚本、短视频、分镜、抖音脚本、B站文案、小红书视频、视频创作。