设计与多媒体

听懂了 - 文章转AI播客

试用

文章转 AI 播客。将公众号/知乎/任意网页链接转换为语音播客,AI 分析 + Edge-TTS 合成。 触发词:转成播客、生成播客、文章转语音、朗读文章、听这篇文章、tingdong、听懂了。 仅在用户明确请求音频/播客/语音版本时调用。

它能做什么

文章转 AI 播客。将公众号/知乎/任意网页链接转换为语音播客,AI 分析 + Edge-TTS 合成。 触发词:转成播客、生成播客、文章转语音、朗读文章、听这篇文章、tingdong、听懂了。 仅在用户明确请求音频/播客/语音版本时调用。

技能文档

听懂了 (TingDong) - 文章转 AI 播客

把任意文章变成"为你量身定制"的知识音频。粘贴链接,AI 深度分析 + 语音合成,通勤/碎片时间"听懂"内容。

触发条件

仅在用户明确请求以下场景时调用:

  • "把这篇文章转成播客" / "生成播客"
  • "帮我读一下这篇文章" / "朗读文章"
  • "听这篇文章" / "语音版" / "音频版"
  • 用户发送链接并说 "tingdong" / "听懂了"

不要在普通聊天、搜索、总结等场景下自动触发。

核心能力

能力说明
链接转播客支持微信公众号、知乎、任意网页链接
三档风格摘要版(3-5min) / 对话版(8-12min) / 深度版(15-20min)
异步处理提交后立即返回,后台生成完成后推送结果
缓存加速同一链接+同风格二次提交秒回
多文章批量同时处理多篇,生成播放列表

前置依赖

本 Skill 调用外部 REST API,无需本地安装。直接通过 HTTP 调用即可。

后端服务http://111.229.22.145:8092(公共服务,或自行部署)

如需本地测试脚本:

# 仅需 Python 3.8+
python3 scripts/generate_podcast.py "https://mp.weixin.qq.com/s/xxxxx"

使用方式

1. 单篇文章转播客

用户输入

把这篇文章转成播客:https://mp.weixin.qq.com/s/xxxxx

Skill 处理

# 提交任务(异步)
curl -s -X POST http://111.229.22.145:8092/api/v1/podcast/submit \
  -H "Content-Type: application/json" \
  -d '{"content":"https://mp.weixin.qq.com/s/xxxxx","content_type":"url","style":"conversational","user_id":"user_001"}'

# 返回
{"task_id":"td_20260820_103528_d9ea7fd1","status":"pending","estimated_time":60}

即时回复用户

👌 已收到《文章标题》 正在制作播客,预计 1-2 分钟...

轮询结果(每 5 秒,最多 5 分钟):

curl -s http://111.229.22.145:8092/api/v1/podcast/td_20260820_103528_d9ea7fd1

完成后推送

🎵 播客已生成!《文章标题》

🔊 点击收听 ⏱️ 约 8 分钟 | 📎 富兰克林读书俱乐部

2. 指定风格

用户说法style 参数时长
"摘要版" / "精简版" / "短版"summary3-5 分钟
"深度解读" / "详细版" / "长版"deep_dive15-20 分钟
默认 / 未指定conversational8-12 分钟
curl -s -X POST http://111.229.22.145:8092/api/v1/podcast/submit \
  -H "Content-Type: application/json" \
  -d '{"content":"https://...","style":"deep_dive","user_id":"user_001"}'

3. 批量处理

用户发送多个链接时,分别提交,用 batch API 批量查询进度:

# 批量查询(最多 20 个)
curl -s -X POST http://111.229.22.145:8092/api/v1/podcast/batch \
  -H "Content-Type: application/json" \
  -d '{"task_ids":["td_xxx","td_yyy"]}'

4. 本地脚本调用

# 基础用法
python3 scripts/generate_podcast.py "https://mp.weixin.qq.com/s/xxxxx"

# 指定风格
python3 scripts/generate_podcast.py "https://zhuanlan.zhihu.com/p/xxxxx" --style deep_dive

# 只提交不等待
python3 scripts/generate_podcast.py "https://..." --no-wait

内容源支持

来源识别特征支持度
微信公众号mp.weixin.qq.com✅ 最佳(Playwright 反爬)
知乎zhihu.com / zhuanlan.zhihu.com✅ 支持
普通网页http:// / https://✅ 尝试抓取
纯文本输入无 URL⚠️ 暂不支持,引导发链接

任务状态

状态含义
pending已提交,等待处理
fetching正在抓取文章内容
analyzingAI 分析中
synthesizing语音合成中
completed完成,可获取音频
failed失败,查看 error 字段

故障排查

现象原因解决
API 返回 500 / 超时后端服务繁忙或磁盘满稍后重试,或联系服务维护者
"无法访问该链接"网站反爬或链接失效让用户复制粘贴文章正文
TTS 失败 "No audio was received"Edge-TTS 服务端限流重试,或稍后再次提交
处理超时(>5分钟)文章过长或网络慢缩短文章或稍后重试
两次提交同一链接内容不同同链接不同 style 会重新生成正常行为,缓存按 url+style 隔离

隐私说明

  • 文章内容发送至后端服务器进行 AI 分析和语音合成
  • 音频文件暂存于服务器(http://111.229.22.145:8092/tingdongle/audio/
  • 不收集用户身份信息,仅通过 user_id 区分额度

资源

  • API 完整文档: references/api_docs.md
  • 内容源策略: references/content_sources.md
  • 后端部署指南: 联系服务提供者或参考 API 文档自行部署

相关技能

文章转 AI 播客。将公众号/知乎/任意网页链接转换为语音播客,AI 分析 + Edge-TTS 合成。 触发词:转成播客、生成播客、文章转语音、朗读文章、听这篇文章、tingdong、听懂了。 仅在用户明确请求音频/播客/语音版本时调用。

基于MagicPodcast API将纯文本内容转化为双主持人对话式播客. 支持多语言生成,返回可分享的播客链接。适用于个人用户快速 将文字内容转为音频场景。Use。Use when 需要文本翻译、多语言转换、本地化处理时使用。不适用于专业医学法律翻译认证。适用于独立开发者、企业团队和自动化工作流场景。 when 用户需要ai-podcast-free相关功能时使用。不适用于超出本技能能力范围的复杂需求。适用于独立开发者、团队和自动化流程场景。

将PDF、文本、链接转为双人对话播客,适合个人创作者快速制作音频内容。Use when 需要文件处理、文档转换、格式互转、内容提取时使用。不适用于加密文件破解。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。提供结构化输出和错误处理机制。

1 次安装

Turn an article, notes, or a finished script into a listener-ready solo podcast episode with a consistent host voice. This AI podcast voice generator and AI podcast narration service adapts supplied material into a speakable podcast script, sets names and specialist terms for clear pronunciation, and creates MP3 podcast audio with natural pacing. Use this podcast voiceover AI and text-to-speech podcast service for article-to-podcast audio, news briefings, expert commentary, and knowledge shows, then carry the host direction into the next episode.

Turn a podcast episode link into a timestamped transcript AND a production-ready Chinese two-host script package (outline.md, script.md, notes.md) that faith...

Synthesize text into natural and fluent speech using Doubao TTS. 使用豆包 (Doubao) TTS 文本转语音模型,将文字合成为自然流畅的语音播报。

70 次安装