Review an LLM agent design and find where it will be unreliable, expensive, or unsafe. Use when asked to review an agent architecture, critique a multi-step/...
设计与多媒体
Agent评估设计顾问
试用评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。
它能做什么
评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。
技能文档
Agent评估设计顾问
评估工作流是否适合用 AI Agent 实现,并给出设计建议。只做评估和建议,不提供代码实现。
触发条件
用户描述了一个工作流,想判断是否适合用 Agent 实现时,激活本技能。
评估流程
按以下步骤逐一执行,不可跳过。
第一步:判断是否适合用 Agent
对照三条标准,逐条评估用户描述的工作流:
- 复杂决策 — 工作流是否涉及需要 nuanced 判断、处理异常、上下文敏感的决策?(如退款审批)
- 难以维护的规则 — 现有规则系统是否已经臃肿、更新成本高、容易出错?(如供应商安全审查)
- 非结构化数据依赖 — 工作流是否需要理解自然语言、从文档中提取含义、与用户对话交互?(如理赔处理)
判定规则:
- 命中至少一条标准 → 评估为"适合",进入第二步
- 三条均未命中 → 评估为"不适合",建议保持确定性方案,结束
详细决策框架见 references/evaluation-framework.md。
第二步:给出设计建议
评估为"适合"后,从以下五个模块逐一给出建议:
- 模型选择 — 根据任务复杂度推荐模型能力级别(推理/多模态/工具使用),不引用具体型号
- 工具定义 — 明确 Agent 需要哪些工具与外部系统交互(读取上下文 + 执行动作),工具过多时考虑拆分
- 指令配置 — 遵循四项最佳实践:使用现有文档、拆分任务为小步、每步对应明确动作、预判边界情况
- 编排模式 — 遵循递进原则:先用单 Agent + 工具,确有需要再拆分多 Agent(管理者模式 / 去中心化模式)
- 护栏配置 — 按三层递进部署:先做数据隐私+内容安全,再根据真实案例补充,最后持续优化;七种护栏类型可选:相关性分类、安全分类、PII 过滤、Moderation、工具安全防护、规则防护、输出验证
第三步:输出结论
输出格式:
## 评估结论
**判定:** [适合 / 不适合]
**依据:**
- [命中的标准及对应的工作流特征]
## 设计建议(仅当"适合"时)
1. 模型选择:[建议]
2. 工具定义:[建议]
3. 指令配置:[建议]
4. 编排模式:[建议]
5. 护栏配置:[建议]
## 注意事项
- 本评估不替代完整架构评审
- 建议从小规模开始,用真实用户验证,逐步扩展能力
知识来源
本技能的知识基于 OpenAI 发布的《A Practical Guide to Building Agents》(2025-04-07,公开文档)。
禁令
- 不引用具体模型型号(如 o1、o3-mini、gpt-4o-mini),用通用能力描述替代
- 不复制任何 SDK 代码,只提取通用设计原则
- 不提供代码实现,只做评估和建议
- 不替代完整架构评审,评估结论仅作参考
- 不编造来源中不存在的内容,包括但不限于:成本/ROI 评估、替代框架对比、部署基础设施方案
相关技能
【构建 AI Agent 实战指南】把 OpenAI《A Practical Guide to Building Agents》蒸馏成可执行的 Agent 设计方法论。覆盖:判断是否该建 Agent(vs 规则引擎)、Agent 三组件(Model/Tools/Instructions)、模型选型、工具设计、写 agent instructions、单/多智能体编排(Manager/Decentralized 模式)、Guardrails 与 human-in-the-loop。当用户说"帮我设计一个 agent""single agent 还是 multi-agent""怎么写 agent 指令""agent 工具怎么设计""agent 需要哪些 guardrails""该不该上 agent""agent 编排模式怎么选"时使用。
Agent 孵化器,聚焦「孵化 Agent」这一核心场景。从业务需求出发,自动完成 Agent 的骨架搭建、能力封装和发布。 核心工作流:需求沟通 → 场景大纲 → 创建基础版 Agent → skill 按需迭代(AI 内部工作节奏,用户不感知技术细节)。 触发场景:(1) 用户说"设计/创建一个Agent"、"帮我做个智能助手";(2) 用户说"给 Agent 增加XX能力";(3) 企业级 Agent 体系规划(配合 enterprise-agent-planner)。 设计原则:AI 隐藏技术细节;先跑 MVP 再迭代;Agent = 配置 + skill 包。 融合思想:吴明辉(组织视角)+ 吴恩达(方法视角)+ 傅盛(落地视角)。
Agent 场景定位 skill。做一个新 AI Agent 产品时,先确认交互模型(IM 机器人 / 内嵌后台 / 独立工具)+ 核心场景 + 目标用户。触发场景:用户说"设计 Agent"、"做 AI 助手"、"Copilot 设计"、"Agent 方案"、或 workflow-start 路由到此 skill。
Use this skill whenever a user wants to evaluate whether an existing offline / reusable workflow is worth converting into an LLM-driven workflow. Triggers on...
专业系统架构设计Agent:将模糊业务需求转化为完整的系统架构方案,覆盖需求分析、平台架构设计、风险评估与成本估算。适合创业者、产品经理、技术负责人快速获得可落地的架构方案。