Design & media

free-tts

Try it

免费 TTS + 声音克隆双引擎。Fish Audio s2.1-pro-free(83 语言、克隆自己声音、voice_id 持久复用、免费至 2026-08-31)+ 小米 MiMo V2.5 TTS(8 种预置音色、文本设计音色、音频克隆、情绪/方言/唱歌标签控制、限时免费)。Use when 用户提到语音合成、TTS、文字转语音、配音、声音克隆、克隆我的声音、音色设计、免费语音生成、Fish Audio、小米 MiMo。

What it does

免费 TTS + 声音克隆双引擎。Fish Audio s2.1-pro-free(83 语言、克隆自己声音、voice_id 持久复用、免费至 2026-08-31)+ 小米 MiMo V2.5 TTS(8 种预置音色、文本设计音色、音频克隆、情绪/方言/唱歌标签控制、限时免费)。Use when 用户提到语音合成、TTS、文字转语音、配音、声音克隆、克隆我的声音、音色设计、免费语音生成、Fish Audio、小米 MiMo。

The skill document

Free TTS · 声音克隆双引擎 🐟🎙️

引擎免费政策强项声音克隆
Fish Audio s2.1-pro-free免费至 2026-08-31(公平使用、无硬性上限)83 语言、~90ms 低延迟、voice_id 持久复用✅ 持久模型 + 即时克隆
小米 MiMo mimo-v2.5-tts限时免费中文预置音色、文本设计音色、情绪/方言/唱歌标签✅ 音频样本克隆(不存模型)

🚀 Step 0:初始化(首次使用必须走)

python /scripts/setup.py check        # 检查两个引擎的 key 状态
python /scripts/setup.py set-fish     # 交互式隐藏输入写入 FISH_API_KEY
python /scripts/setup.py set-mimo     # 交互式隐藏输入写入 MIMO_API_KEY
python /scripts/setup.py test-fish    # 验证连通性(需 Clash 代理在线)
python /scripts/setup.py test-mimo    # 验证连通性(国内直连)

key 缺失时把下面的指引原样给用户

🐟 Fish Audio(克隆自己声音首选):

  1. 打开 https://fish.audio/ 注册/登录(GitHub 或 Google 登录,免费,无需信用卡)
  2. 打开 https://fish.audio/app/api-keys/ → Create API Key → 复制(32 字符)

📱 小米 MiMo(中文音色/情绪控制首选):

  1. 用小米账号登录 https://platform.xiaomimimo.com/(没有就去 id.mi.com 注册)
  2. 控制台 → API Keys(platform.xiaomimimo.com/#/console/api-keys)→ 创建(格式 sk-xxxxx)

用户拿到 key 后:写入 Windows 用户级环境变量(不硬编码、不回显明文、优先用 set-fish/set-mimo 隐藏输入;若用户直接贴 key,用 [Environment]::SetEnvironmentVariable("FISH_API_KEY","","User") 写入并提醒下次别贴明文)。

🧭 引擎选择路由

需求命令
克隆自己声音(持久、反复用)fish_clone.pyfish_tts.py --cached-name
一次性参考音频模仿fish_tts.py --reference-audio
多语言(英/日/韩等 83 种)fish_tts.py
中文预置音色快速出片mimo_tts.py --voice 苏打
文字设计新音色(无需音频)mimo_tts.py --design "..."
临时克隆(每次传音频、不存模型)mimo_tts.py --clone-audio
情绪/方言/唱歌/哭笑控制mimo_tts.py --style "(东北话)..."

🎙️ 工作流 A:克隆自己的声音(Fish)

  1. 录音要求:单人、无背景音乐、≥10 秒(推荐 1-2 分钟)、wav/mp3/m4a/opus
  2. python scripts/fish_clone.py --audio "E:/桌面/我的声音.m4a" --title "锋哥的声音" --cache-name "锋哥的声音"
  3. python scripts/fish_tts.py --text "嘿兄弟们" --cached-name "锋哥的声音" --output out.mp3

🎙️ 工作流 B:文字转语音(零克隆)

python scripts/mimo_tts.py --text "你好" --voice 冰糖 --output hello.wav      # 中文预置
python scripts/fish_tts.py --text "Hello world" --output hello.mp3            # 无声参考、多语言

🎙️ 工作流 C:声音克隆(MiMo,不存模型)

python scripts/mimo_tts.py --text "..." --clone-audio "声音.mp3" --output out.wav
# 音频仅支持 mp3/wav、≤7MB;可加 --style "温柔一点,语速放慢"

🧰 声音管理

python scripts/fish_voices.py list                                  # 列出 Fish 已克隆声音 + 本地缓存
python scripts/fish_voices.py delete --cached-name "锋哥的声音" --yes

⚠️ 警告

  1. Fish 免费层 2026-08-31 截止(已延期两次,变动官方会提前通知);到期后 --model s2.1-pro 切付费层
  2. MiMo 为"限时免费",商用/大量使用前查控制台账单明细页确认政策
  3. 网络:MiMo 是国内 API 直连即可;Fish 是海外 API,直连超时 → 先确认 Clash 在线,再 set HTTPS_PROXY=http://127.0.0.1:7897(Clash 默认端口,以实际为准)
  4. 免费层请求数据可能被用于模型改进;敏感语音用付费层
  5. key 只进环境变量;脚本输出永远脱敏(abcd***1234

详细参数:references/fish-api.mdreferences/mimo-api.md

Related skills

Fish Speech AI 配音工具 — 声音克隆 + 情绪分析 + 多段合成。用于短剧/AI剧配音制作,支持参考音频克隆音色、智能情绪识别、批量台词生成、音色库管理。

1 installs

Convert text into high-quality, emotional speech reading using Kling TTS. 使用可灵 (Kling) TTS 模型,将文本转化为高质量、情感丰富的语音朗读。

65 installs

Generate customized speech that highly restores the timbre by uploading reference audio using Kling Audio Clone. 使用可灵 (Kling) 声音克隆模型,通过上传参考音频,生成高度还原该音色的定制语音。

64 installs

Generate multilingual, highly natural audio using Gemini 2.5 text-to-speech. 使用 Gemini 2.5 强大的文本转语音能力,生成多语言、高自然度的音频。

61 installs

将章节文件(支持 .md 和 .txt)转换为有声小说音频,使用小米MiMo TTS API。支持批量处理、长文本自动分段、多种音色和风格。当用户要求"生成有声小说"、"把小说转成音频"、"TTS合成"、"文字转语音"、"章节转音频"时触发。

1 installs

轻量级文本转语音工具,支持多语言TTS与基础音效生成,适合个人内容创作。Use when 需要文本翻译、多语言转换、本地化处理时使用。不适用于专业医学法律翻译认证。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 installs