设计与多媒体

ai-capabilities

试用

AI能力聚合器,聚合5大引擎(人设档案/AIRI情感/InstantID照片/TTS语音/Kolors图像),提供19个标准化MCP工具。v4.0已合并cosyvoice统一TTS能力(15种情感控制+8种音色+三层降级SiliconFlow/KittenTTS/Edge-TTS+PPS人物一致性+预处理管道+场景组合prompt+智能分块)。触发:AI能力/人设管理/情感分析/语音合成/TTS/图像生成/照片生成/cosyvoice/情感控制/音色选择

它能做什么

AI能力聚合器,聚合5大引擎(人设档案/AIRI情感/InstantID照片/TTS语音/Kolors图像),提供19个标准化MCP工具。v4.0已合并cosyvoice统一TTS能力(15种情感控制+8种音色+三层降级SiliconFlow/KittenTTS/Edge-TTS+PPS人物一致性+预处理管道+场景组合prompt+智能分块)。触发:AI能力/人设管理/情感分析/语音合成/TTS/图像生成/照片生成/cosyvoice/情感控制/音色选择

技能文档

ai-capabilities 技能

AI能力聚合器,统一封装5大引擎(人设档案/AIRI情感/InstantID照片/TTS语音/Kolors图像)的19个MCP工具。通过MCP协议对外暴露标准化工具接口,其他Skill可按需调用,无需各自对接底层API。

使用场景

  • 人设档案管理:创建/查询/更新/验证人设档案,列出所有人设
  • AIRI情感引擎:获取人设信息、分析8维情感向量、检查人设一致性、获取情感状态、更新人设、注入上下文
  • InstantID照片生成:基于人设描述生成场景适配照片,检查模型状态
  • TTS语音合成:多引擎语音合成(SiliconFlow/KittenTTS/Edge-TTS),获取音色和引擎列表
  • Kolors图像生成:5种场景模板图像生成,查看场景列表和引擎状态

工作流

  1. 需求识别: 解析用户输入,判断所需AI能力类型(人设管理/情感分析/照片生成/语音合成/图像生成)
  2. 参数校验: 检查必填参数是否完整,API Key是否已配置,不完整则返回错误提示
  3. 能力调用: 根据识别结果调用 ai-capabilities MCP对应工具,传入格式化参数
  4. 结果处理: 解析MCP返回结果,提取有效内容,过滤冗余信息
  5. 结果返回: 将处理后的结果以结构化格式返回给调用方

工具列表

人设档案引擎 (persona_profile_engine)

工具名描述参数
create_persona创建新的人设档案(含voice/text_style/photos配置)agent_id(必填), name, age, gender, profile_overrides
get_persona_profile获取完整人设档案(含voice/text_style/photos)agent_id(必填)
aicap_update_persona更新人设档案字段(支持嵌套字段如voice.voice_id)agent_id(必填), updates(必填)
validate_persona验证人设档案完整性和一致性(评分+问题列表)agent_id(必填)
aicap_list_personas列出所有人设档案(摘要信息)

AIRI情感引擎 (airi_engine)

工具名描述参数
aicap_get_persona获取指定Agent的人设信息(从SOUL.md读取)persona_id(必填)
aicap_analyze_emotion分析消息的8维情感向量text(必填)
check_persona_consistency检查内容是否符合人设定义(属性一致性/历史冲突/风格匹配)persona_id(必填), content(必填)
get_emotion获取用户当前情感状态(从MEMORY.md缓存读取)user_id(必填)
update_persona_airi更新人设字段值(Airi引擎,写入SOUL.md)persona_id(必填), updates(必填)
inject_context融合AirI context-prompt逻辑,将人设/记忆/情感格式化为LLM可读的System Promptpersona_id(必填), message(必填), target_emotion

InstantID照片引擎 (instantid_engine)

工具名描述参数
aicap_generate_photo基于基础照片+人设描述生成符合身份的照片(场景适配: daily/travel/work/holiday)agent_id(必填), scene, description
check_model_status检查InstantID模型和InsightFace库是否就绪

TTS语音引擎 (tts_engine)

工具名描述参数
synthesize语音合成v2.0(SiliconFlow CosyVoice2主力+KittenTTS降级+Edge-TTS兜底)text(必填), voice_id, engine, speed, pitch
get_voices获取可用音色列表(8种预设)
get_engines获取TTS v2.0引擎列表及状态

Kolors图像引擎 (kolors_engine)

优先级标注: 【P1备选】kolors_engine是ai-capabilities-mcp内置的Kolors图像生成引擎(5种场景模板:product/lifestyle/avatar/banner/social_card)。kolors-mcp已删除(BUG-V6-002),Kolors真人照片场景(8种场景+地标打卡)请使用flux-mcp.generate_photo,通用Kolors生图可使用本引擎。

工具名描述参数
generate_image使用Kolors模型生成图像(5种场景模板: product/lifestyle/avatar/banner/social_card)prompt(必填), scene, width, height
list_scenes列出可用的图像生成场景模板
check_kolors_status检查Kolors引擎状态和配置

输入格式

{
  "tool": "create_persona|aicap_analyze_emotion|aicap_generate_photo|synthesize|generate_image|...",
  "params": {
    "agent_id": "agent_001",
    "name": "Luna"
  }
}

输出格式

{
  "success": true,
  "data": {
    "content": "工具返回的具体数据",
    "tool": "create_persona"
  }
}

异常处理

错误代码异常场景处理方式
AI_E001API Key未配置或无效返回错误提示,引导用户检查SILICONFLOW_API_KEY环境变量
AI_E002API调用超时(>30秒)提示服务繁忙,建议稍后重试,记录超时日志
AI_E003API返回非200状态码解析错误信息,返回具体原因(余额不足/限流/模型不可用)
AI_E004工具不存在返回参数校验错误,列出可用工具名
AI_E005输入参数为空返回参数校验错误,要求提供有效输入
AI_E006MCP服务不可用降级提示AI服务暂时不可用,记录告警日志

示例

示例1: 创建人设档案

# 创建新员工人设
调用 create_persona 工具,agent_id="agent_001", name="Luna", age=22, gender="female"
→ 返回创建成功的人设档案

示例2: 情感分析

# 分析用户消息情感
调用 aicap_analyze_emotion 工具,text="最近好累啊不想上班"
→ 返回8维情感向量(sadness=0.7, trust=0.5, ...)

示例3: 语音合成

# 合成语音
调用 synthesize 工具,text="欢迎关注我的公众号", voice_id="female_gentle"
→ 返回音频文件路径

示例4: 图像生成

# 生成产品展示图
调用 generate_image 工具,prompt="AI绘画工具界面截图", scene="product"
→ 返回生成的图片路径

相关技能

免费AI模型配置领域负载物。标准化Agnes AI、智谱、商汤、小米、美团等平台的免费模型配置流程,支持文本/图像/视频/音频生成、语音识别(ASR)与信息图生成,及灵活多模态路径(单条、组合、批量生成与拼接)。核心:API Key管理、接口配置、模型选择、多模态生成(Agnes AI特有,采用基本命令组合复杂命令架构)、音频生成(简单合成+TTS语音合成)、语音识别与合成(ASR/TTS,含音色克隆/音色设计)。6域24种任务。触发词:模型配置、免费模型、API配置、模型设置、AI模型、图像生成、视频生成、音频生成、语音识别、语音合成、音色克隆、信息图生成、TTS配音、音视频合并、meta-

腾讯云 MPS 音视频与图片处理、AI 生成、内容理解。涉及以下场景必须触发:【转码】转码/压缩/格式转换/转封装/H.264/H.265/AV1/码率/分辨率。【画质增强】画质增强/画质修复/老片修复/超分/真人增强/漫剧增强/防抖/人脸保真/1080P/2K/4K。【音频】音频分离/人声提取/伴奏提取/去人声/降噪/音量均衡。【字幕】字幕提取/字幕翻译/语音识别/语音转文字/ASR/OCR字幕/SRT/视频翻译。【擦除】去字幕/去水印/人脸模糊/车牌模糊/马赛克。【配音】语音合成/TTS/文字转语音/AI配音/配音/声音克隆/音色复刻。【图增强】图片超分/美颜/降噪/色彩增强/低光照增强。

Generate images, videos, and audio with Piccc AI (皮可AI), or query and download existing media tasks. Use when the user asks to create visual or audio media with Piccc AI, discover its current models or voices, check an asynchronous task, or download completed results. Do not use for editing existing

Use when the user asks to generate an image, create a video, make music, create audio, synthesize speech, submit a media task, poll a task, or produce genera...

14 次安装