Design & media

Agent评估设计顾问

Try it

评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。

What it does

评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。

The skill document

Agent评估设计顾问

评估工作流是否适合用 AI Agent 实现,并给出设计建议。只做评估和建议,不提供代码实现。

触发条件

用户描述了一个工作流,想判断是否适合用 Agent 实现时,激活本技能。

评估流程

按以下步骤逐一执行,不可跳过。

第一步:判断是否适合用 Agent

对照三条标准,逐条评估用户描述的工作流:

  1. 复杂决策 — 工作流是否涉及需要 nuanced 判断、处理异常、上下文敏感的决策?(如退款审批)
  2. 难以维护的规则 — 现有规则系统是否已经臃肿、更新成本高、容易出错?(如供应商安全审查)
  3. 非结构化数据依赖 — 工作流是否需要理解自然语言、从文档中提取含义、与用户对话交互?(如理赔处理)

判定规则:

  • 命中至少一条标准 → 评估为"适合",进入第二步
  • 三条均未命中 → 评估为"不适合",建议保持确定性方案,结束

详细决策框架见 references/evaluation-framework.md

第二步:给出设计建议

评估为"适合"后,从以下五个模块逐一给出建议:

  1. 模型选择 — 根据任务复杂度推荐模型能力级别(推理/多模态/工具使用),不引用具体型号
  2. 工具定义 — 明确 Agent 需要哪些工具与外部系统交互(读取上下文 + 执行动作),工具过多时考虑拆分
  3. 指令配置 — 遵循四项最佳实践:使用现有文档、拆分任务为小步、每步对应明确动作、预判边界情况
  4. 编排模式 — 遵循递进原则:先用单 Agent + 工具,确有需要再拆分多 Agent(管理者模式 / 去中心化模式)
  5. 护栏配置 — 按三层递进部署:先做数据隐私+内容安全,再根据真实案例补充,最后持续优化;七种护栏类型可选:相关性分类、安全分类、PII 过滤、Moderation、工具安全防护、规则防护、输出验证

第三步:输出结论

输出格式:

## 评估结论

**判定:** [适合 / 不适合]

**依据:**
- [命中的标准及对应的工作流特征]

## 设计建议(仅当"适合"时)

1. 模型选择:[建议]
2. 工具定义:[建议]
3. 指令配置:[建议]
4. 编排模式:[建议]
5. 护栏配置:[建议]

## 注意事项
- 本评估不替代完整架构评审
- 建议从小规模开始,用真实用户验证,逐步扩展能力

知识来源

本技能的知识基于 OpenAI 发布的《A Practical Guide to Building Agents》(2025-04-07,公开文档)。

禁令

  1. 不引用具体模型型号(如 o1、o3-mini、gpt-4o-mini),用通用能力描述替代
  2. 不复制任何 SDK 代码,只提取通用设计原则
  3. 不提供代码实现,只做评估和建议
  4. 不替代完整架构评审,评估结论仅作参考
  5. 不编造来源中不存在的内容,包括但不限于:成本/ROI 评估、替代框架对比、部署基础设施方案

Related skills

Review an LLM agent design and find where it will be unreliable, expensive, or unsafe. Use when asked to review an agent architecture, critique a multi-step/...

1 installs

【构建 AI Agent 实战指南】把 OpenAI《A Practical Guide to Building Agents》蒸馏成可执行的 Agent 设计方法论。覆盖:判断是否该建 Agent(vs 规则引擎)、Agent 三组件(Model/Tools/Instructions)、模型选型、工具设计、写 agent instructions、单/多智能体编排(Manager/Decentralized 模式)、Guardrails 与 human-in-the-loop。当用户说"帮我设计一个 agent""single agent 还是 multi-agent""怎么写 agent 指令""agent 工具怎么设计""agent 需要哪些 guardrails""该不该上 agent""agent 编排模式怎么选"时使用。

Agent 孵化器,聚焦「孵化 Agent」这一核心场景。从业务需求出发,自动完成 Agent 的骨架搭建、能力封装和发布。 核心工作流:需求沟通 → 场景大纲 → 创建基础版 Agent → skill 按需迭代(AI 内部工作节奏,用户不感知技术细节)。 触发场景:(1) 用户说"设计/创建一个Agent"、"帮我做个智能助手";(2) 用户说"给 Agent 增加XX能力";(3) 企业级 Agent 体系规划(配合 enterprise-agent-planner)。 设计原则:AI 隐藏技术细节;先跑 MVP 再迭代;Agent = 配置 + skill 包。 融合思想:吴明辉(组织视角)+ 吴恩达(方法视角)+ 傅盛(落地视角)。

5 installs

Agent 场景定位 skill。做一个新 AI Agent 产品时,先确认交互模型(IM 机器人 / 内嵌后台 / 独立工具)+ 核心场景 + 目标用户。触发场景:用户说"设计 Agent"、"做 AI 助手"、"Copilot 设计"、"Agent 方案"、或 workflow-start 路由到此 skill。

3 installs

Use this skill whenever a user wants to evaluate whether an existing offline / reusable workflow is worth converting into an LLM-driven workflow. Triggers on...

专业系统架构设计Agent:将模糊业务需求转化为完整的系统架构方案,覆盖需求分析、平台架构设计、风险评估与成本估算。适合创业者、产品经理、技术负责人快速获得可落地的架构方案。