批量将指定目录下的 .mp4 视频文件提取音频转为 .mp3。 支持指定源目录和输出目录,未指定输出时默认创建 [源目录]_audio 文件夹。 自动管理 Python 虚拟环境,保持文件夹层级结构,兼容 python3 和 python。 高频触发词:mp4转mp3、视频转音频、批量提取音频、mp4 to mp3、extract audio from videos、听视频、提取网课音频、把视频里的声音抠出来、视频转mp3。
Design & media
QQ音乐转mp3技能
Try it将QQ音乐下载的音频文件(OGG/FLAC/M4A/WAV/AAC 等)批量转换为通用 MP3 格式,保留元数据。支持单文件与整目录批处理,自动检测 ffmpeg 并选择最优编码参数。
What it does
将QQ音乐下载的音频文件(OGG/FLAC/M4A/WAV/AAC 等)批量转换为通用 MP3 格式,保留元数据。支持单文件与整目录批处理,自动检测 ffmpeg 并选择最优编码参数。
The skill document
QQ音乐转 MP3(Audio → MP3)
将QQ音乐下载的音频文件(.ogg、.flac、.m4a、.wav、.aac、.opus 等)转换为通用 MP3 格式,保留元数据(标题、艺术家、专辑等),支持单文件与整目录批处理。
使用时机
✅ 使用此技能当: 需要将QQ音乐下载的 OGG/FLAC/M4A 等音频转为 MP3,使其能在更多设备/软件上播放;需要批量转换一整个目录的音频文件。
❌ 不要用当: 文件已经是 MP3 且无需转码;文件为 QQ音乐加密格式(.qmc0、.mflac 等,需先用解密工具处理)。
前置依赖
- ffmpeg(含
libmp3lame编码器)— 转码核心工具 - 检查方式:
ffmpeg -version,确认输出含--enable-libmp3lame
支持的输入格式
| 格式 | 扩展名 | 说明 |
|---|---|---|
| OGG Vorbis | .ogg | QQ音乐常见下载格式 |
| FLAC | .flac | 无损压缩 |
| M4A / AAC | .m4a .aac | Apple AAC |
| WAV | .wav | 无压缩 |
| Opus | .opus | 低码率高效编码 |
| WMA | .wma | Windows Media |
| AIFF | .aiff .aif | Apple 无压缩 |
⚠️ 加密格式(
.qmc0.qmc2.qmc3.qmcflac.qmcmp3.mflac.mmp3)需要先用 qmcdump 或 Unlock Music 解密后再用本技能转码。
铁律
- 保留元数据 — 转码时使用 ffmpeg 默认的 metadata copy,不主动剥离标题/艺术家/专辑信息。
- 不覆盖原文件 — 输出 MP3 与源文件同目录、同文件名(仅扩展名改为
.mp3);若已存在同名.mp3则跳过并提示。 - VBR 优先 — 使用
-q:a 2(VBR,约 170-210 kbps),在音质与体积间取得最佳平衡。 - 错误不中断(批量模式)— 单个文件转码失败时记录错误并继续处理下一个,最终汇总报告。
单文件转码
ffmpeg -y -i "INPUT.ogg" -vn -acodec libmp3lame -q:a 2 "OUTPUT.mp3"
-y:覆盖已存在输出(单文件模式由 agent 控制,默认加-y)-vn:丢弃视频轨(如有),只保留音频-q:a 2:VBR 质量 2(约 190 kbps,接近透明)- 元数据(TITLE、ARTIST、ALBUM 等)自动保留
质量档位参考
| 参数 | 码率 | 体积 | 适用场景 |
|---|---|---|---|
-q:a 0 | ~245 kbps | 最大 | 极致音质(源为 FLAC 时推荐) |
-q:a 2 | ~190 kbps | 中等 | 默认推荐,透明级 |
-q:a 4 | ~170 kbps | 较小 | 日常听感足够 |
-q:a 6 | ~135 kbps | 小 | 语音/有声书 |
-b:a 320k | 320 kbps CBR | 大 | 强制 CBR 兼容老旧设备 |
批量转码
使用本技能附带的脚本 scripts/qq_to_mp3.sh:
# 转换整个目录(递归)
bash scripts/qq_to_mp3.sh /path/to/music/
# 转换单个文件
bash scripts/qq_to_mp3.sh /path/to/song.ogg
# 指定质量档位(0-6,默认 2)
bash scripts/qq_to_mp3.sh /path/to/music/ -q 0
# 指定输出目录
bash scripts/qq_to_mp3.sh /path/to/music/ -o /path/to/output/
脚本行为:
- 自动检测 ffmpeg 是否可用
- 递归扫描
.ogg .flac .m4a .aac .wav .opus .wma .aiff .aif文件 - 同名
.mp3已存在时跳过 - 单文件失败不中断,最终输出汇总(成功/失败/跳过计数)
- 保留原始目录结构到输出目录
标准流程
- 确认输入 — 用户提供文件路径或目录路径;确认格式是否为本技能支持的类型。
- 检测环境 — 运行
ffmpeg -version确认可用;若不可用,提示安装方式:- macOS:
brew install ffmpeg - Ubuntu/Debian:
sudo apt install ffmpeg - Windows:从 ffmpeg.org 下载
- macOS:
- 执行转码:
- 单文件 → 直接
ffmpeg命令 - 多文件/目录 → 使用
scripts/qq_to_mp3.sh脚本
- 单文件 → 直接
- 汇报结果 — 输出每个文件的转码信息(源格式 → MP3、时长、码率、文件大小对比)。
- 可选:清理 — 询问用户是否删除源文件(默认保留,不自动删除)。
反模式(禁止)
- ❌ 删除或覆盖原始音频文件
- ❌ 使用固定 CBR 320k 处理语音文件(浪费空间)
- ❌ 不检查 ffmpeg 是否可用就执行
- ❌ 批量转码中某个文件失败就全部中止
- ❌ 对已经是 MP3 的文件重复转码(有损 → 有损,音质下降)
核心原则
保留元数据 · 不覆盖原文件 · VBR 优先 · 批量容错。 音频转码是格式迁移,不是音质升级——源文件质量是上限。
Related skills
快速提取视频中的背景音乐、人声及音频内容为 MP3/WAV,支持本地视频文件与抖音等平台分享链接(链接经 qhkit 解析成直链后提取),方便二次编辑和内容创作。当用户要求提取视频音频、扒BGM、视频转音频、拿视频里的音乐/口播时必须触发。关键词:LinkPix、qhkit、音频提取、提取BGM、视频转音频、扒音乐、提取人声、视频配乐、MP3提取、ffmpeg。
当用户想要**音频增强**、**提升音质**、**修复录音**、**降噪**、**语音修复**、**高保真音频**、**48kHz超分辨率**、**清理会议录音**、**音乐音质提升**、**批量处理音频**时自动触发。 集成 **VoiceFixer**(通用语音修复)与 **AudioSR**(高保真音频超级分辨率到48kHz)两种专业技术,支持单个音频文件或整个目录批量处理。 默认使用 VoiceFixer 进行降噪和清晰度提升;当用户提到“高保真”“音乐增强”“提升采样率”“48kHz”等需求时,自动切换到 AudioSR 模式。 支持 wav、mp3、flac、m4a、ogg 等常见
腾讯云 MPS 音视频与图片处理、AI 生成、内容理解。涉及以下场景必须触发:【转码】转码/压缩/格式转换/转封装/H.264/H.265/AV1/码率/分辨率。【画质增强】画质增强/画质修复/老片修复/超分/真人增强/漫剧增强/防抖/人脸保真/1080P/2K/4K。【音频】音频分离/人声提取/伴奏提取/去人声/降噪/音量均衡。【字幕】字幕提取/字幕翻译/语音识别/语音转文字/ASR/OCR字幕/SRT/视频翻译。【擦除】去字幕/去水印/人脸模糊/车牌模糊/马赛克。【配音】语音合成/TTS/文字转语音/AI配音/配音/声音克隆/音色复刻。【图增强】图片超分/美颜/降噪/色彩增强/低光照增强。
端到端 AI 音乐创作技能:用户录制一段自己的声音 + 自己写的歌词 + 风格要求(或让 AI 推荐风格/问问题),生成一首用本人音色演唱的完整歌曲。集成 2026 年最先进 AI 音乐技术栈——零样本语音克隆(So-VITS-SVC 4.1)、端到端音乐生成(Suno v4)、AI 歌词创作(LyricsGPT...
Convert, compress, merge, split, clip, inspect, and extract audio locally with FFmpeg, plus decode supported music-cache formats including pure-Python Ximala...