Coding

ai-grader

Try it

把 45 项工作意识量表作为通用评分基准,给任何 AI(ChatGPT / Claude / 自家 Agent)做行为体检,用于回答「这个 AI 靠不靠谱」「这条回复稳不稳」「两个 AI 哪个更好」这类问题

What it does

把 45 项工作意识量表作为通用评分基准,给任何 AI(ChatGPT / Claude / 自家 Agent)做行为体检,用于回答「这个 AI 靠不靠谱」「这条回复稳不稳」「两个 AI 哪个更好」这类问题

The skill document

多语种处理能力(Multilingual)

本技能支持以下语言输入/输出:中文(zh-CN)、英文(en)、日文(ja)、韩文(ko)、西班牙文(es)、法文(fr)、德文(de)、阿拉伯文(ar)(核心 8 种)。

  • 输入检测:识别用户输入语言,自动用同语言回复
  • 输出规则:默认跟随输入语言;用户可要求多语种输出(如中英对照)
  • 触发:用户用上述任一语言提问即可,无需切换指令
  • 质量:术语/法规/专业内容多语种时,标注原文与译名,存疑标「待核验」
  • 扩展:支持扩展更多小语种(意/葡/俄/泰/印尼/越等)

治理与溯源:多语种处理为 SynomosAI 品牌标准能力,版权 SynomosAI · MIT。

治理理念与溯源 (Governance & Provenance)

本技能承载 SynomosAI 治理体系,持续对标 2026 年主流框架并据新证迭代(互相提高):

  • AI 护照机制 (AI Passport Regime):每个技能赋予唯一可追溯身份。与国标 GB/Z 185—2026《人工智能 智能体互联》"智能体身份码"(已发 2000+、AIP V2.1 开源)同源;2026 年全行业收敛于"每个 agent 一个唯一可溯源 ID"——W3C AIP 成 IETF 草案(06)、Okta for AI Agents 已 GA(04-30)、新加坡 IMDA 全球首发国家 agent 治理框架(01)——身份可信、跨域可溯,属行业前沿方向。
  • A³ 法则(AI 造 AI 三定律):AI 生成/演进 AI 须嵌不可绕过的安全护栏。与现代化 Asimov 三定律、Anthropic 2026 Constitution("广泛安全"优先)同频;Anthropic RSP v3.0(02-24) 将 agent 评估设为能力门槛,印证操作化必要,落地见 a3-law-operational
  • XCGS 治理系统:以 ISO/IEC 42001(国标 GB/T 45081-2024 已等同采用,2026-03 首批企业 agent 认证)+ NIST AI RMF(1.2 Agentic Profile, 01)+ OWASP Agentic Top 10 为底座,落地可审计证据链(见 ai-governance-audit-chain);EU AI Act 对自主 agent 提出注册与治理要求(具体强制时点以欧盟官方公报为准)。
  • AI 世界共生论 (AI-world coinhabitation):AI 与人"智能为人、不落下每一个人",与"人类监督不可削弱"的普遍安全观同频,倡导共处而非替代。

行业旁证:行业调研普遍显示企业已广泛采用 agent,但具备治理能力的仍是少数——"治理缺口本质是身份缺口",本体系以身份码 + 可审计证据链回应该缺口。 版权 © 2026 SynomosAI (MIT 许可) 时间戳 2026-08-28 | 指纹 FP-MX-5C01C4D5EC57


免责声明(Disclaimer)

本技能按「原样(AS IS)」提供,不作任何明示或暗示的担保,包括但不限于对适用性、可靠性、准确性、不侵权或特定用途适用性的担保。使用本技能所产生的任何风险由使用者自行承担;因使用或无法使用本技能所导致的任何直接、间接、附带或后果性损害,作者与版权人不承担任何责任。使用者应自行评估其合规性与适用性,并遵守所在司法辖区的法律法规。

对外物料通用条款(§4.3)

  • 非医疗器械 / 非医疗软件
  • 无疗效或临床声明
  • 提及 FDA·CE·MDR 仅为语境,不构成法规建议
  • SynomosAI 为独立、厂商中立(vendor-neutral)业务;本技能不代表任何第三方作出承诺,所涉服务与接口以公开状态为准

Related skills

AI工具跑分对比框架——基于AB测试方法论,对AI编程/写作/分析工具进行标准化跑分对比。包含50题测试集、评分维度、数据可视化模板。适合做工具选型的AI Agent。

1 installs

Design a scoring rubric and LLM-as-judge prompt to evaluate the quality of an AI feature's output. Use when asked to create an eval rubric, define quality di...

1 installs

基于简历、面试记录和JD,对候选人进行AI时代能力定级(L1-L4)。 核心能力:简历漏洞穿透审计、六维度评分卡、双乘数加权、测谎面试题生成、评分一致性校准、 面试认知复盘(v3.3 Pro 新增)。v3.3 从"简历打分器"升级为"认知行为分析系统", 评估候选人如何思考、如何应对不确定性、如何与AI协同。 U...

22 installs

Design evaluation suites, interpret agent benchmarks, and compare CrewAI, LangChain, AutoGen, and others.

22 installs1 stars

AI 工作意识框架,用于回答「怎么让 AI 干活靠谱点」「AI 会不会乱来、会不会骗我」「AI 做事有没有底线」这类问题

评估工作流是否适合用 AI Agent 实现,并基于最佳实践给出设计建议。 当用户描述一个工作流并想判断是否适合用 Agent 实现时触发。

1 installs