Generate, inpaint, and outpaint music with ACE Step on RunComfy via the `runcomfy` CLI. ACE Step is StepFun-AI's open-weights music foundation model — tag-driven composition (genre, mood, instruments), multilingual lyrics with section markers, 5 s to 4 min stereo output, $0.0002–0.0003 per second (≈ 27× cheaper than ElevenLabs Music). Four endpoints: ACE Step text-to-audio (the default), ACE Step 1.5 text-to-audio (50+ language lyrics, refined structured-lyric handling), ACE Step audio-inpaint (regenerate a time range inside an existing track), ACE Step audio-outpaint (extend an existing track before or after). Triggers on "ace step", "ace-step", "acestep", "ACE music", "open music model", "cheap AI music", "inpaint audio", "audio inpaint", "extend music", "audio outpaint", "lengthen track", "music with tags", or any explicit ask to generate or edit music with ACE Step.
编程
ACE音乐生成-免费版
试用通过ACE-Step模型免费生成带人声的AI歌曲,支持多语种、多风格,适合个人创作者快速出曲。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
它能做什么
通过ACE-Step模型免费生成带人声的AI歌曲,支持多语种、多风格,适合个人创作者快速出曲。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
技能文档
核心功能: 本技能提供中文交互、化工作流场景等能力。
ACE音乐生成工具 - 免费版
概述
ACE音乐生成免费版是一款面向个人用户的AI音乐创作工具。通过自然语言描述即可生成包含人声、歌词的完整歌曲,无需乐理知识,几分钟即可获得原创音乐作品。
本版本依托 ACE-Step 1.5 模型能力,提供基础的文生音乐(text2music)功能,支持多种音乐风格与语言,适合短视频创作者、独立开发者及音乐爱好者快速产出音乐内容。
核心能力
| 能力项 | 免费版支持 | 说明 |
|---|---|---|
| 文本生成音乐 | 是 | 输入描述即可生成歌曲 |
| 自定义歌词 | 是 | 支持 Verse/Chorus 结构标记 |
| 纯音乐模式 | 是 | 仅生成伴奏无人声 |
| 多语种演唱 | 是 | 支持中英日韩等 |
| 时长控制 | 限制 | 最长 60 秒 |
| 批量生成 | 否 | 单次一首 |
| 风格翻唱 | 否 | PRO 版支持 |
| 片段重绘 | 否 | PRO 版支持 |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。 |
核心功能执行
用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置。
输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作
结果处理与输出
用output_format参数进行配置。
输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:ACE、Step、模型免费生成带人、支持多语种、多风格、适合个人创作者快、速出曲、音乐生成免费版、面向个人内容创作、音乐生成工具、文本描述生成完整、含人声与歌词、支持流行、爵士等多种风格、提供中文、日文等多语种演唱、可调节时长、BPM、调式等基础参数等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
使用场景
场景一:短视频背景音乐
用户制作 30 秒短视频,需要一段轻快的流行风格背景音乐。
scripts/generate.sh "upbeat pop song about summer vacation" \
--duration 30 \
--instrumental \
--output summer_bgm.mp3
示例
音乐创作者希望快速将一段歌词转化为可听的人声 demo。
scripts/generate.sh "gentle acoustic ballad, female vocal" \
--lyrics "[Verse 1]\n阳光洒进窗台\n\n[Chorus]\n我们都是追梦人" \
--duration 60 \
--language zh \
--output demo.mp3
场景三:学习/工作背景音
用户希望生成一段 lo-fi 助眠或专注背景音乐。
scripts/generate.sh "lo-fi hip hop beats, chill, rainy night" \
--instrumental \
--duration 60 \
--output lofi_focus.mp3
不适用场景
以下场景ACE音乐生成-免费版不适合处理:
- 版权受保护的媒体内容处理
- 实时直播推流
- 专业影视后期
触发条件
需要视频处理、音频编辑、媒体转换、配音生成时使用。不适用于非本工具能力范围的需求。
快速开始
领先步:配置 API Key
# 注册免费账号获取 Key
export ACE_MUSIC_API_KEY="${API_KEY:?请设置环境变量}"
获取地址:https://acemusic.ai/playground/api-key
第二步:执行生成命令
scripts/generate.sh "rock anthem, energetic" \
--bpm 140 \
--key "E minor" \
--output rock.mp3
第三步:获取结果
脚本将生成文件路径输出到 stdout,直接展示给用户即可。
配置示例
基础配置项说明:
# 环境变量
ACE_MUSIC_API_KEY=your_key # 必填
ACE_MUSIC_BASE_URL=https://api.acemusic.ai # 默认值
# 常用参数组合
# 纯音乐 + 长时长
--instrumental --duration 60
# 自定义歌词 + 指定语言
--lyrics "[Verse]...\n[Chorus]..." --language zh
# 固定随机种子(可复现)
--seed 42
优选实践
- 提示词要具体:描述风格、乐器、情绪,例如"jazz, saxophone solo, smoky bar, melancholic"
- 歌词用结构标记:使用
[Verse]、[Chorus]、[Bridge]分段,生成效果更佳 - 时长选择:免费版建议 30-60 秒,过短可能不完整,过长受限于配额
- 语言匹配:歌词为中文时务必加
--language zh,否则可能出现发音异常 - 先试短后做长:先用 30 秒测试风格是否符合预期,再生成完整版本
常见问题
Q1:生成的音乐有杂音或人声不清晰?
A:尝试调整提示词,避免过多风格堆叠;确认网络稳定;如使用 --sample-mode,改为手动指定歌词模式。
已知限制
A:API 本身免费,但免费版单次时长限制为 60 秒,且不支持批量生成。如需更长时长或批量,请使用 PRO 版。
Q3:可以生成纯中文歌词的歌曲吗?
A:可以,使用 --language zh 参数,并在 --lyrics 中提供中文歌词即可。
Q4:生成的 MP3 文件保存在哪?
A:默认保存至当前工作目录,文件名由 --output 参数指定。如不指定,脚本自动生成随机文件名。
Q5:如何复现同一首歌曲?
A:使用相同的提示词、歌词和 --seed 参数值即可生成相似结果。
依赖说明
运行环境
- Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统: Windows / macOS / Linux
- 运行时: Bash shell + curl(脚本依赖)
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| ACE Music API | 外部 API | 必需 | 官网注册免费获取 |
| curl | 命令行工具 | 必需 | 系统自带 |
| jq | JSON 处理 | 推荐 | 包管理器安装 |
| base64 | 解码工具 | 必需 | 系统自带 |
API Key 配置
- 环境变量名:
ACE_MUSIC_API_KEY - 获取方式: 访问
https://acemusic.ai/playground/api-key注册免费账号 - 存储建议: 写入
.env文件或系统环境变量,避免硬编码到脚本
可用性分类
- 分类: MD+execute(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
- 说明: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作,核心生成流程依赖外部API
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
效率量化分析
| 操作场景 | 手动耗时 | 自动化耗时 | 效率提升 |
|---|---|---|---|
| 文件解析与提取 | 5-10分钟/个 | <5秒/个 | 60-120x |
| 批量文件处理(100个) | 8-16小时 | <5分钟 | 96-192x |
| API调用与响应解析 | 2-3分钟/次 | <1秒/次 | 120-180x |
| 多接口数据聚合 | 15-30分钟 | <10秒 | 90-180x |
| 命令执行与结果收集 | 3-5分钟/次 | <2秒/次 | 90-150x |
| 重复任务批量执行 | 因任务而异 | 线性缩减 | 5-50x |
| 错误排查与修复 | 10-30分钟 | <30秒 | 20-60x |
差异化对比
| 对比维度 | 本技能 | 传统手动方式 | 通用脚本工具 |
|---|---|---|---|
| 自动化程度 | 全流程自动 | 完全手动 | 部分自动 |
| 错误处理 | 内置错误恢复 | 依赖人工经验 | 基本try-catch |
| 可复用性 | 参数化配置 | 一次性脚本 | 模板化 |
| 安全合规 | 内置安全检查 | 无安全保障 | 无安全保障 |
| 适用场景 | 核心功能 | 通用场景 | 通用场景 |
相关技能
Generate songs from prompts or lyrics through an ACE-Step-compatible API backend. Use when users want text-to-music, lyrics-to-song, fast prompt iteration, s...
Generate songs, instrumentals, or lyrics-driven tracks through a structured OpenClaw-native workflow with anti-sparse prompt engineering and quality verification. Provider-agnostic — works with any music backend the runtime exposes (ACE-Step, MusicGen, Stable Audio, mmx).
整合4个互补skill的营销组合包,覆盖Creative等领域。组合内各skill协同工作,提供从数据输入到结果输出的端到端处理能力。针对创作灵感与工具分散难统一、ai-image-gen: 存在耗时低效问题 (慢)等痛点提供解决方案。包含4个经质量审核的skill,整体评分81.5分。以ace-music为核心,搭配互补skill形成完整工作流。
Generate AI music on RunComfy via the `runcomfy` CLI — a smart router across the music-model catalog. Routes to ElevenLabs AI Music Generation (premium 44.1 kHz stereo vocal tracks, 5 s–5 min, $0.0083/s) and ACE Step / ACE Step 1.5 (StepFun-AI open-weights, tag-driven composition, multilingual lyrics, $0.0002–0.0003/s, ~27× cheaper), plus ACE Step audio-inpaint (regenerate a time range inside an existing track) and ACE Step audio-outpaint (extend a track before or after). Picks the right model for the user's actual intent — premium vocal hook, cheap background music library, multilingual pop song, repair a bad chorus, lengthen a 30 s draft into a 2 min cut — and ships each model's documented prompting patterns plus the minimal `runcomfy run` invoke. Triggers on "generate music", "make a song", "AI music", "background music", "instrumental track", "soundtrack", "jingle", "theme music", "royalty-free music", "compose", "music with lyrics", "extend music", "fix this song", "inpaint music"
Create original songs, AI-generated music, lyrics-to-song tracks, instrumentals, background music, video soundtracks, jingles, multilingual songs, and reference-led arrangements from a clear creative brief. This AI music generator and AI song maker develops genre, mood, structure, singable lyrics, vocal direction, and production style, then creates reviewable audio with Suno 5.5 or another model you explicitly choose. Use it as an AI music studio for songwriting, an AI lyrics writer, text-to-music creation, BGM generation, brand music, podcast themes, game music, bilingual songs, or focused new versions of reference audio. Review vocals, pronunciation, duration, loop points, and arrangement fit after generation, then refine the strongest result.