编程

ACE音乐生成-免费版

试用

通过ACE-Step模型免费生成带人声的AI歌曲,支持多语种、多风格,适合个人创作者快速出曲。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

它能做什么

通过ACE-Step模型免费生成带人声的AI歌曲,支持多语种、多风格,适合个人创作者快速出曲。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

技能文档

核心功能: 本技能提供中文交互、化工作流场景等能力。

ACE音乐生成工具 - 免费版

概述

ACE音乐生成免费版是一款面向个人用户的AI音乐创作工具。通过自然语言描述即可生成包含人声、歌词的完整歌曲,无需乐理知识,几分钟即可获得原创音乐作品。

本版本依托 ACE-Step 1.5 模型能力,提供基础的文生音乐(text2music)功能,支持多种音乐风格与语言,适合短视频创作者、独立开发者及音乐爱好者快速产出音乐内容。

核心能力

能力项免费版支持说明
文本生成音乐输入描述即可生成歌曲
自定义歌词支持 Verse/Chorus 结构标记
纯音乐模式仅生成伴奏无人声
多语种演唱支持中英日韩等
时长控制限制最长 60 秒
批量生成单次一首
风格翻唱PRO 版支持
片段重绘PRO 版支持
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。

核心功能执行

input_params参数进行配置。

输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

参数配置与调用

config_options参数进行配置。

输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用config_options参数,支持修改/重置/导入操作

结果处理与输出

output_format参数进行配置。

输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:ACE、Step、模型免费生成带人、支持多语种、多风格、适合个人创作者快、速出曲、音乐生成免费版、面向个人内容创作、音乐生成工具、文本描述生成完整、含人声与歌词、支持流行、爵士等多种风格、提供中文、日文等多语种演唱、可调节时长、BPM、调式等基础参数等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。

使用场景

场景一:短视频背景音乐

用户制作 30 秒短视频,需要一段轻快的流行风格背景音乐。

scripts/generate.sh "upbeat pop song about summer vacation" \
  --duration 30 \
  --instrumental \
  --output summer_bgm.mp3

示例

音乐创作者希望快速将一段歌词转化为可听的人声 demo。

scripts/generate.sh "gentle acoustic ballad, female vocal" \
  --lyrics "[Verse 1]\n阳光洒进窗台\n\n[Chorus]\n我们都是追梦人" \
  --duration 60 \
  --language zh \
  --output demo.mp3

场景三:学习/工作背景音

用户希望生成一段 lo-fi 助眠或专注背景音乐。

scripts/generate.sh "lo-fi hip hop beats, chill, rainy night" \
  --instrumental \
  --duration 60 \
  --output lofi_focus.mp3

不适用场景

以下场景ACE音乐生成-免费版不适合处理:

  • 版权受保护的媒体内容处理
  • 实时直播推流
  • 专业影视后期

触发条件

需要视频处理、音频编辑、媒体转换、配音生成时使用。不适用于非本工具能力范围的需求。

快速开始

领先步:配置 API Key

# 注册免费账号获取 Key
export ACE_MUSIC_API_KEY="${API_KEY:?请设置环境变量}"

获取地址:https://acemusic.ai/playground/api-key

第二步:执行生成命令

scripts/generate.sh "rock anthem, energetic" \
  --bpm 140 \
  --key "E minor" \
  --output rock.mp3

第三步:获取结果

脚本将生成文件路径输出到 stdout,直接展示给用户即可。

配置示例

基础配置项说明:

# 环境变量
ACE_MUSIC_API_KEY=your_key         # 必填
ACE_MUSIC_BASE_URL=https://api.acemusic.ai  # 默认值

# 常用参数组合
# 纯音乐 + 长时长
--instrumental --duration 60

# 自定义歌词 + 指定语言
--lyrics "[Verse]...\n[Chorus]..." --language zh

# 固定随机种子(可复现)
--seed 42

优选实践

  1. 提示词要具体:描述风格、乐器、情绪,例如"jazz, saxophone solo, smoky bar, melancholic"
  2. 歌词用结构标记:使用 [Verse][Chorus][Bridge] 分段,生成效果更佳
  3. 时长选择:免费版建议 30-60 秒,过短可能不完整,过长受限于配额
  4. 语言匹配:歌词为中文时务必加 --language zh,否则可能出现发音异常
  5. 先试短后做长:先用 30 秒测试风格是否符合预期,再生成完整版本

常见问题

Q1:生成的音乐有杂音或人声不清晰?

A:尝试调整提示词,避免过多风格堆叠;确认网络稳定;如使用 --sample-mode,改为手动指定歌词模式。

已知限制

A:API 本身免费,但免费版单次时长限制为 60 秒,且不支持批量生成。如需更长时长或批量,请使用 PRO 版。

Q3:可以生成纯中文歌词的歌曲吗?

A:可以,使用 --language zh 参数,并在 --lyrics 中提供中文歌词即可。

Q4:生成的 MP3 文件保存在哪?

A:默认保存至当前工作目录,文件名由 --output 参数指定。如不指定,脚本自动生成随机文件名。

Q5:如何复现同一首歌曲?

A:使用相同的提示词、歌词和 --seed 参数值即可生成相似结果。

依赖说明

运行环境

  • Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统: Windows / macOS / Linux
  • 运行时: Bash shell + curl(脚本依赖)

依赖详情

依赖项类型是否必需获取方式
ACE Music API外部 API必需官网注册免费获取
curl命令行工具必需系统自带
jqJSON 处理推荐包管理器安装
base64解码工具必需系统自带

API Key 配置

  • 环境变量名: ACE_MUSIC_API_KEY
  • 获取方式: 访问 https://acemusic.ai/playground/api-key 注册免费账号
  • 存储建议: 写入 .env 文件或系统环境变量,避免硬编码到脚本

可用性分类

  • 分类: MD+execute(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
  • 说明: 基于Markdown的AI Skill,通过自然语言指令驱动Agent完成操作,核心生成流程依赖外部API

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

安全注意事项

风险类型防范措施
API密钥泄露通过环境变量配置,禁止硬编码到代码或配置文件中
命令执行风险仅执行白名单命令,避免拼接用户输入到命令行参数中
网络通信安全使用HTTPS协议,验证SSL证书有效性
敏感数据暴露输出结果中不包含密钥、令牌等敏感信息

使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。

效率量化分析

操作场景手动耗时自动化耗时效率提升
文件解析与提取5-10分钟/个<5秒/个60-120x
批量文件处理(100个)8-16小时<5分钟96-192x
API调用与响应解析2-3分钟/次<1秒/次120-180x
多接口数据聚合15-30分钟<10秒90-180x
命令执行与结果收集3-5分钟/次<2秒/次90-150x
重复任务批量执行因任务而异线性缩减5-50x
错误排查与修复10-30分钟<30秒20-60x

差异化对比

对比维度本技能传统手动方式通用脚本工具
自动化程度全流程自动完全手动部分自动
错误处理内置错误恢复依赖人工经验基本try-catch
可复用性参数化配置一次性脚本模板化
安全合规内置安全检查无安全保障无安全保障
适用场景核心功能通用场景通用场景

相关技能

Generate, inpaint, and outpaint music with ACE Step on RunComfy via the `runcomfy` CLI. ACE Step is StepFun-AI's open-weights music foundation model — tag-driven composition (genre, mood, instruments), multilingual lyrics with section markers, 5 s to 4 min stereo output, $0.0002–0.0003 per second (≈ 27× cheaper than ElevenLabs Music). Four endpoints: ACE Step text-to-audio (the default), ACE Step 1.5 text-to-audio (50+ language lyrics, refined structured-lyric handling), ACE Step audio-inpaint (regenerate a time range inside an existing track), ACE Step audio-outpaint (extend an existing track before or after). Triggers on "ace step", "ace-step", "acestep", "ACE music", "open music model", "cheap AI music", "inpaint audio", "audio inpaint", "extend music", "audio outpaint", "lengthen track", "music with tags", or any explicit ask to generate or edit music with ACE Step.

1 次安装

Generate songs from prompts or lyrics through an ACE-Step-compatible API backend. Use when users want text-to-music, lyrics-to-song, fast prompt iteration, s...

25 次安装

Generate songs, instrumentals, or lyrics-driven tracks through a structured OpenClaw-native workflow with anti-sparse prompt engineering and quality verification. Provider-agnostic — works with any music backend the runtime exposes (ACE-Step, MusicGen, Stable Audio, mmx).

10 次安装

整合4个互补skill的营销组合包,覆盖Creative等领域。组合内各skill协同工作,提供从数据输入到结果输出的端到端处理能力。针对创作灵感与工具分散难统一、ai-image-gen: 存在耗时低效问题 (慢)等痛点提供解决方案。包含4个经质量审核的skill,整体评分81.5分。以ace-music为核心,搭配互补skill形成完整工作流。

1 次安装

Generate AI music on RunComfy via the `runcomfy` CLI — a smart router across the music-model catalog. Routes to ElevenLabs AI Music Generation (premium 44.1 kHz stereo vocal tracks, 5 s–5 min, $0.0083/s) and ACE Step / ACE Step 1.5 (StepFun-AI open-weights, tag-driven composition, multilingual lyrics, $0.0002–0.0003/s, ~27× cheaper), plus ACE Step audio-inpaint (regenerate a time range inside an existing track) and ACE Step audio-outpaint (extend a track before or after). Picks the right model for the user's actual intent — premium vocal hook, cheap background music library, multilingual pop song, repair a bad chorus, lengthen a 30 s draft into a 2 min cut — and ships each model's documented prompting patterns plus the minimal `runcomfy run` invoke. Triggers on "generate music", "make a song", "AI music", "background music", "instrumental track", "soundtrack", "jingle", "theme music", "royalty-free music", "compose", "music with lyrics", "extend music", "fix this song", "inpaint music"

1 次安装

Create original songs, AI-generated music, lyrics-to-song tracks, instrumentals, background music, video soundtracks, jingles, multilingual songs, and reference-led arrangements from a clear creative brief. This AI music generator and AI song maker develops genre, mood, structure, singable lyrics, vocal direction, and production style, then creates reviewable audio with Suno 5.5 or another model you explicitly choose. Use it as an AI music studio for songwriting, an AI lyrics writer, text-to-music creation, BGM generation, brand music, podcast themes, game music, bilingual songs, or focused new versions of reference audio. Review vocals, pronunciation, duration, loop points, and arrangement fit after generation, then refine the strongest result.