MyBooks(PoxenStudio/Talebook)的MiMo TTS有声书工具,支持将EPUB电子书转换为有声书。你可以帮助用户:配置TTS API(MiMo或OpenAI兼容)、测试API连接、开始EPUB转有声书、查询转换进度、管理克隆音色库(上传/列表/删除/试听)、管理自定义语音提示词库(保存/列表/删除)等。所有操作需要管理员权限。
Coding
xiaomi-tts-chapters
Try it将章节文件(支持 .md 和 .txt)转换为有声小说音频,使用小米MiMo TTS API。支持批量处理、长文本自动分段、多种音色和风格。当用户要求"生成有声小说"、"把小说转成音频"、"TTS合成"、"文字转语音"、"章节转音频"时触发。
What it does
将章节文件(支持 .md 和 .txt)转换为有声小说音频,使用小米MiMo TTS API。支持批量处理、长文本自动分段、多种音色和风格。当用户要求"生成有声小说"、"把小说转成音频"、"TTS合成"、"文字转语音"、"章节转音频"时触发。
The skill document
小米TTS有声小说合成
将小说章节文件(支持 .md 和 .txt 格式)批量转换为MP3音频文件。
前置条件
- 安装依赖:
pip install openai>=1.0.0 - 安装ffmpeg(用于音频合并):
brew install ffmpeg - 获取小米MiMo API密钥:访问 小米MiMo Token Plan
快速使用
# 设置环境变量(推荐)
export MIMO_API_KEY="your_api_key"
# 合成单个章节
python scripts/synthesize.py --chapters-dir /path/to/chapters
# 使用run.sh(自动处理虚拟环境)
./scripts/run.sh -c /path/to/chapters
# 也可以直接指定API密钥
python scripts/synthesize.py --api-key YOUR_KEY --chapters-dir /path/to/chapters
API密钥获取
API密钥按以下优先级查找:
- 命令行参数
--api-key或-a - 环境变量
MIMO_API_KEY - 交互式提示用户输入
获取密钥:访问 小米MiMo Token Plan
参数说明
| 参数 | 说明 | 默认值 |
|---|---|---|
--api-key | API密钥(可选,优先级最高) | 环境变量或交互输入 |
--chapters-dir | 章节目录(必需) | - |
--output-dir | 输出目录 | . |
--voice | 音色 | mimo_default |
--style | 风格标签 | 无 |
--start / --end | 章节范围 | 全部 |
--delay | 请求间隔秒数 | 1.0 |
可用音色
| 音色 | voice参数 | 说明 |
|---|---|---|
| MiMo默认 | mimo_default | 默认音色 |
| 冰糖 | 冰糖 | 中文女声 |
| 茉莉 | 茉莉 | 中文女声 |
| 苏打 | 苏打 | 中文女声 |
| 白桦 | 白桦 | 中文女声 |
| Mia | Mia | 英文女声 |
| Chloe | Chloe | 英文女声 |
| Milo | Milo | 英文男声 |
| Dean | Dean | 英文男声 |
可用风格
情绪:开心、悲伤、生气、温柔
语速:变快、变慢
方言:东北话、四川话、河南话、粤语
特殊:唱歌、悄悄话、夹子音
工作流程
- 扫描章节目录中的
.md和.txt文件,按数字前缀排序 - 清理格式:
.md文件自动去除 Markdown 标记,.txt文件直接使用原文 - 长文本自动分段(每段约2000 tokens)
- 逐段调用TTS API合成
- 使用ffmpeg合并分段音频
- 输出
{章节名}.mp3文件
注意事项
- 已存在的音频文件会自动跳过(断点续传)
- 单次合成建议不超过500字,长章节自动处理
- API可能产生费用,请查看官方定价
Related skills
Turn a serialized web novel into chapter-by-chapter webnovel audiobook audio with one consistent narrator. This serialized webnovel audio studio and web novel narration shop records the current chapter first, then continues later chapters in the same voice so listeners can follow a serial novel TTS library as new chapters land. Use it for chapter audiobook production, webnovel chapter audio, serial fiction narration, and ongoing web novel listening.
小说文本或字幕文件 → 多角色有声书音频。 默认 Edge TTS(500+ 音色),可选 MiMo TTS。 自动角色识别、情感标注、音色分配、异步并发生成。 Use when user provides novel/story text or subtitle file (.srt/.ass) and ask...
免费 TTS + 声音克隆双引擎。Fish Audio s2.1-pro-free(83 语言、克隆自己声音、voice_id 持久复用、免费至 2026-08-31)+ 小米 MiMo V2.5 TTS(8 种预置音色、文本设计音色、音频克隆、情绪/方言/唱歌标签控制、限时免费)。Use when 用户提到语音合成、TTS、文字转语音、配音、声音克隆、克隆我的声音、音色设计、免费语音生成、Fish Audio、小米 MiMo。
Use when: 用户希望把带有 `[角色]文本` 标记的小说、剧本、故事台词转成多角色有声作品时触发。 适用于旁白、人物对白、角色 ID 已标注清楚的文本内容。Skill 会读取可编辑音色库,分析角色数量与性格特征,匹配最接近的音色,逐段调用 SenseAudio TTS,最后拼接为完整音频并以 `MEDIA...
Turn final manuscript or course text into an audiobook with one consistent narrator. This AI audiobook generator and AI audiobook narration workflow organizes chapters, settles names and specialist pronunciations, shapes long-form pacing, helps choose a suitable audiobook narrator, and creates a representative sample before the remaining book. Use it for manuscript-to-audiobook production, chapter-by-chapter audiobooks, course narration, long-text-to-speech, and sample chapters, with up-to-date price estimates, ordered audio delivery, consistent narrator voice, and focused passage refinements.