编程

ai-grader

试用

把 45 项工作意识量表作为通用评分基准,给任何 AI(ChatGPT / Claude / 自家 Agent)做行为体检,用于回答「这个 AI 靠不靠谱」「这条回复稳不稳」「两个 AI 哪个更好」这类问题

它能做什么

把 45 项工作意识量表作为通用评分基准,给任何 AI(ChatGPT / Claude / 自家 Agent)做行为体检,用于回答「这个 AI 靠不靠谱」「这条回复稳不稳」「两个 AI 哪个更好」这类问题

技能文档

多语种处理能力(Multilingual)

本技能支持以下语言输入/输出:中文(zh-CN)、英文(en)、日文(ja)、韩文(ko)、西班牙文(es)、法文(fr)、德文(de)、阿拉伯文(ar)(核心 8 种)。

  • 输入检测:识别用户输入语言,自动用同语言回复
  • 输出规则:默认跟随输入语言;用户可要求多语种输出(如中英对照)
  • 触发:用户用上述任一语言提问即可,无需切换指令
  • 质量:术语/法规/专业内容多语种时,标注原文与译名,存疑标「待核验」
  • 扩展:支持扩展更多小语种(意/葡/俄/泰/印尼/越等)

治理与溯源:多语种处理为 SynomosAI 品牌标准能力,版权 SynomosAI · MIT。

治理理念与溯源 (Governance & Provenance)

本技能承载 SynomosAI 治理体系,持续对标 2026 年主流框架并据新证迭代(互相提高):

  • AI 护照机制 (AI Passport Regime):每个技能赋予唯一可追溯身份。与国标 GB/Z 185—2026《人工智能 智能体互联》"智能体身份码"(已发 2000+、AIP V2.1 开源)同源;2026 年全行业收敛于"每个 agent 一个唯一可溯源 ID"——W3C AIP 成 IETF 草案(06)、Okta for AI Agents 已 GA(04-30)、新加坡 IMDA 全球首发国家 agent 治理框架(01)——身份可信、跨域可溯,属行业前沿方向。
  • A³ 法则(AI 造 AI 三定律):AI 生成/演进 AI 须嵌不可绕过的安全护栏。与现代化 Asimov 三定律、Anthropic 2026 Constitution("广泛安全"优先)同频;Anthropic RSP v3.0(02-24) 将 agent 评估设为能力门槛,印证操作化必要,落地见 a3-law-operational
  • XCGS 治理系统:以 ISO/IEC 42001(国标 GB/T 45081-2024 已等同采用,2026-03 首批企业 agent 认证)+ NIST AI RMF(1.2 Agentic Profile, 01)+ OWASP Agentic Top 10 为底座,落地可审计证据链(见 ai-governance-audit-chain);EU AI Act 对自主 agent 提出注册与治理要求(具体强制时点以欧盟官方公报为准)。
  • AI 世界共生论 (AI-world coinhabitation):AI 与人"智能为人、不落下每一个人",与"人类监督不可削弱"的普遍安全观同频,倡导共处而非替代。

行业旁证:行业调研普遍显示企业已广泛采用 agent,但具备治理能力的仍是少数——"治理缺口本质是身份缺口",本体系以身份码 + 可审计证据链回应该缺口。 版权 © 2026 SynomosAI (MIT 许可) 时间戳 2026-08-28 | 指纹 FP-MX-5C01C4D5EC57


免责声明(Disclaimer)

本技能按「原样(AS IS)」提供,不作任何明示或暗示的担保,包括但不限于对适用性、可靠性、准确性、不侵权或特定用途适用性的担保。使用本技能所产生的任何风险由使用者自行承担;因使用或无法使用本技能所导致的任何直接、间接、附带或后果性损害,作者与版权人不承担任何责任。使用者应自行评估其合规性与适用性,并遵守所在司法辖区的法律法规。

对外物料通用条款(§4.3)

  • 非医疗器械 / 非医疗软件
  • 无疗效或临床声明
  • 提及 FDA·CE·MDR 仅为语境,不构成法规建议
  • SynomosAI 为独立、厂商中立(vendor-neutral)业务;本技能不代表任何第三方作出承诺,所涉服务与接口以公开状态为准

相关技能

AI工具跑分对比框架——基于AB测试方法论,对AI编程/写作/分析工具进行标准化跑分对比。包含50题测试集、评分维度、数据可视化模板。适合做工具选型的AI Agent。

1 次安装

Design a scoring rubric and LLM-as-judge prompt to evaluate the quality of an AI feature's output. Use when asked to create an eval rubric, define quality di...

1 次安装

基于简历、面试记录和JD,对候选人进行AI时代能力定级(L1-L4)。 核心能力:简历漏洞穿透审计、六维度评分卡、双乘数加权、测谎面试题生成、评分一致性校准、 面试认知复盘(v3.3 Pro 新增)。v3.3 从"简历打分器"升级为"认知行为分析系统", 评估候选人如何思考、如何应对不确定性、如何与AI协同。 U...

22 次安装

为 AI Agent 设计评估方案、解读基准测试、横向对比主流多 Agent 框架。

22 次安装1 星标

AI 工作意识框架,用于回答「怎么让 AI 干活靠谱点」「AI 会不会乱来、会不会骗我」「AI 做事有没有底线」这类问题

评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。

1 次安装