编程

purevocals-uvr-automator

试用

当用户想要**一键批量从音频文件中提取超干净纯人声(干声 / Vocals Only)**、去除伴奏/背景音乐时,自动调用此技能。 一键音频人声分离工具。专门从音频文件(.mp3/.wav/.flac等)中提取超干净干声(Acapella)或去除背景音制作伴奏。 核心用途:支持单个音频文件或整个文件夹批量处理(.mp3/.wav/.flac 等格式),输出高质量无杂音干声,自动在输入同级创建 [输入文件夹]_vocals 文件夹,完美保留原目录结构。 高频触发场景包括: - 翻唱练习、翻唱视频制作、B站/抖音/小红书演唱素材清洗 - 卡拉OK 伴奏制作(只保留人声) - 音乐制作中的人声分

它能做什么

当用户想要**一键批量从音频文件中提取超干净纯人声(干声 / Vocals Only)**、去除伴奏/背景音乐时,自动调用此技能。 一键音频人声分离工具。专门从音频文件(.mp3/.wav/.flac等)中提取超干净干声(Acapella)或去除背景音制作伴奏。 核心用途:支持单个音频文件或整个文件夹批量处理(.mp3/.wav/.flac 等格式),输出高质量无杂音干声,自动在输入同级创建 [输入文件夹]_vocals 文件夹,完美保留原目录结构。 高频触发场景包括: - 翻唱练习、翻唱视频制作、B站/抖音/小红书演唱素材清洗 - 卡拉OK 伴奏制作(只保留人声) - 音乐制作中的人声分离(vocal isolation / stem separation) - 音频素材清洗、原音轨提取、去背景音处理 - 翻唱素材制作、卡拉OK伴奏生成、音频后期清洗。 用户常用自然语言表述: “帮我提取干声”“把这首歌的伴奏去掉,只留清唱”“批量分离文件夹里的所有人声”“做翻唱要纯人声”“卡拉OK 干声提取”“vocal remover”“UVR 人声分离”“去除伴奏”“音频人声隔离”“stem 分离 vocals”等。 支持顶级 UVR 模型,默认推荐速度最快且干净度最高的 shibing624-chinese-kenlm-klm,也支持卡拉OK 专用模型。自动检测 GPU(CUDA 加速)或 CPU,自动创建并管理虚拟环境,无需用户手动配置。

技能文档

PureVocals-UVR-Automator

功能概述:一键将带伴奏的音频文件批量转换为超干净的纯人声(Vocals Only)。专为翻唱、卡拉OK、音乐素材清洗等场景设计,输出质量高、速度快、操作零门槛。

支持的模型(推荐顺序)

  1. shibing624-chinese-kenlm-klm —— 默认推荐(速度最快 + 干净度最高,适合中文歌曲)
  2. 6_HP_Karaoke-UVR.pth —— 高质量卡拉OK 模式(你原来的常用设置)
  3. UVR-MDX-NET-Karaoke_2.onnx —— 极致速度,适合超大批量处理

执行步骤

  1. 输入解析:支持单个音频文件路径,或整个文件夹路径(会递归处理所有支持格式)。
  2. 输出位置:若未指定输出目录,默认在输入路径同级自动创建 [输入文件夹名]_vocals 文件夹,保持原文件夹结构不变。
  3. 启动命令(Agent 会自动选择优先级):
    (python3 scripts/purevocals.py "<输入路径>" ["<输出目录>"] [--model <模型名>] [--window_size <数值>] [--aggression <数值>] [--chunk_duration <秒数>] [--sample_mode]) || (python scripts/purevocals.py "<输入路径>" ["<输出目录>"] [--model <模型名>] [--window_size <数值>] [--aggression <数值>] [--chunk_duration <秒数>] [--sample_mode])
    

相关技能

当用户想要**音频增强**、**提升音质**、**修复录音**、**降噪**、**语音修复**、**高保真音频**、**48kHz超分辨率**、**清理会议录音**、**音乐音质提升**、**批量处理音频**时自动触发。 集成 **VoiceFixer**(通用语音修复)与 **AudioSR**(高保真音频超级分辨率到48kHz)两种专业技术,支持单个音频文件或整个目录批量处理。 默认使用 VoiceFixer 进行降噪和清晰度提升;当用户提到“高保真”“音乐增强”“提升采样率”“48kHz”等需求时,自动切换到 AudioSR 模式。 支持 wav、mp3、flac、m4a、ogg 等常见

18 次安装

批量将指定目录下的 .mp4 视频文件提取音频转为 .mp3。 支持指定源目录和输出目录,未指定输出时默认创建 [源目录]_audio 文件夹。 自动管理 Python 虚拟环境,保持文件夹层级结构,兼容 python3 和 python。 高频触发词:mp4转mp3、视频转音频、批量提取音频、mp4 to mp3、extract audio from videos、听视频、提取网课音频、把视频里的声音抠出来、视频转mp3。

25 次安装

面向个人用户的 AI 文本痕迹去除工具,让写作更自然。Use when 需要生成营销文案、写作内容、标题优化、内容创作时使用。不适用于纯技术文档撰写。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 次安装

Separate vocals and instrument stems on PoYo / poyo.ai via `https://api.poyo.ai/api/generate/submit`; use for `separate-vocals`, `stem-split`, `upload-and-se...

2 次安装

当用户想要**把长音频切成小段**、**音频切片**、**音频分割**、**把音频分成固定时长片段**、**制作语音数据集**、**准备Karaoke素材**、**翻唱音频切片**时自动触发。 支持单个音频文件或整个文件夹(支持递归),自动用 ffmpeg 把音频按指定秒数切成小片段,完美保留原始文件夹结构,并智能选择输出路径。 常见触发口语: - “帮我把这个音频切成60秒一段” - “把这个长音频分割成小段” - “音频切片,这个文件夹” - “把语音文件切成每段30秒” - “制作数据集,把音频切片” - “Karaoke素材切片” - “翻唱音频分割” - “把MP3切成小段” -

21 次安装