Coding

xiaomi-tts-chapters

Try it

将章节文件(支持 .md 和 .txt)转换为有声小说音频,使用小米MiMo TTS API。支持批量处理、长文本自动分段、多种音色和风格。当用户要求"生成有声小说"、"把小说转成音频"、"TTS合成"、"文字转语音"、"章节转音频"时触发。

What it does

将章节文件(支持 .md 和 .txt)转换为有声小说音频,使用小米MiMo TTS API。支持批量处理、长文本自动分段、多种音色和风格。当用户要求"生成有声小说"、"把小说转成音频"、"TTS合成"、"文字转语音"、"章节转音频"时触发。

The skill document

小米TTS有声小说合成

将小说章节文件(支持 .md 和 .txt 格式)批量转换为MP3音频文件。

前置条件

  1. 安装依赖:pip install openai>=1.0.0
  2. 安装ffmpeg(用于音频合并):brew install ffmpeg
  3. 获取小米MiMo API密钥:访问 小米MiMo Token Plan

快速使用

# 设置环境变量(推荐)
export MIMO_API_KEY="your_api_key"

# 合成单个章节
python scripts/synthesize.py --chapters-dir /path/to/chapters

# 使用run.sh(自动处理虚拟环境)
./scripts/run.sh -c /path/to/chapters

# 也可以直接指定API密钥
python scripts/synthesize.py --api-key YOUR_KEY --chapters-dir /path/to/chapters

API密钥获取

API密钥按以下优先级查找:

  1. 命令行参数 --api-key-a
  2. 环境变量 MIMO_API_KEY
  3. 交互式提示用户输入

获取密钥:访问 小米MiMo Token Plan

参数说明

参数说明默认值
--api-keyAPI密钥(可选,优先级最高)环境变量或交互输入
--chapters-dir章节目录(必需)-
--output-dir输出目录.
--voice音色mimo_default
--style风格标签
--start / --end章节范围全部
--delay请求间隔秒数1.0

可用音色

音色voice参数说明
MiMo默认mimo_default默认音色
冰糖冰糖中文女声
茉莉茉莉中文女声
苏打苏打中文女声
白桦白桦中文女声
MiaMia英文女声
ChloeChloe英文女声
MiloMilo英文男声
DeanDean英文男声

可用风格

情绪:开心悲伤生气温柔 语速:变快变慢 方言:东北话四川话河南话粤语 特殊:唱歌悄悄话夹子音

工作流程

  1. 扫描章节目录中的 .md.txt 文件,按数字前缀排序
  2. 清理格式:.md 文件自动去除 Markdown 标记,.txt 文件直接使用原文
  3. 长文本自动分段(每段约2000 tokens)
  4. 逐段调用TTS API合成
  5. 使用ffmpeg合并分段音频
  6. 输出 {章节名}.mp3 文件

注意事项

  • 已存在的音频文件会自动跳过(断点续传)
  • 单次合成建议不超过500字,长章节自动处理
  • API可能产生费用,请查看官方定价

Related skills

MyBooks(PoxenStudio/Talebook)的MiMo TTS有声书工具,支持将EPUB电子书转换为有声书。你可以帮助用户:配置TTS API(MiMo或OpenAI兼容)、测试API连接、开始EPUB转有声书、查询转换进度、管理克隆音色库(上传/列表/删除/试听)、管理自定义语音提示词库(保存/列表/删除)等。所有操作需要管理员权限。

1 installs1 stars

Turn a serialized web novel into chapter-by-chapter webnovel audiobook audio with one consistent narrator. This serialized webnovel audio studio and web novel narration shop records the current chapter first, then continues later chapters in the same voice so listeners can follow a serial novel TTS library as new chapters land. Use it for chapter audiobook production, webnovel chapter audio, serial fiction narration, and ongoing web novel listening.

小说文本或字幕文件 → 多角色有声书音频。 默认 Edge TTS(500+ 音色),可选 MiMo TTS。 自动角色识别、情感标注、音色分配、异步并发生成。 Use when user provides novel/story text or subtitle file (.srt/.ass) and ask...

1 installs

免费 TTS + 声音克隆双引擎。Fish Audio s2.1-pro-free(83 语言、克隆自己声音、voice_id 持久复用、免费至 2026-08-31)+ 小米 MiMo V2.5 TTS(8 种预置音色、文本设计音色、音频克隆、情绪/方言/唱歌标签控制、限时免费)。Use when 用户提到语音合成、TTS、文字转语音、配音、声音克隆、克隆我的声音、音色设计、免费语音生成、Fish Audio、小米 MiMo。

1 installs

Use when: 用户希望把带有 `[角色]文本` 标记的小说、剧本、故事台词转成多角色有声作品时触发。 适用于旁白、人物对白、角色 ID 已标注清楚的文本内容。Skill 会读取可编辑音色库,分析角色数量与性格特征,匹配最接近的音色,逐段调用 SenseAudio TTS,最后拼接为完整音频并以 `MEDIA...

23 installs1 stars

Turn final manuscript or course text into an audiobook with one consistent narrator. This AI audiobook generator and AI audiobook narration workflow organizes chapters, settles names and specialist pronunciations, shapes long-form pacing, helps choose a suitable audiobook narrator, and creates a representative sample before the remaining book. Use it for manuscript-to-audiobook production, chapter-by-chapter audiobooks, course narration, long-text-to-speech, and sample chapters, with up-to-date price estimates, ordered audio delivery, consistent narrator voice, and focused passage refinements.