安全

AI Gen Guard -生成式 AI 服务合规护栏

试用

生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清单。 核心能力: - 🛡️ 生成式 AI 服务场景自动识别(大模型/智能对话/AIGC 等关键词触发) - ✅ 5 维度合规检查:备案登记、训练数据、内容安全、用户权益、标识义务 - 📐 办法 + 配套强制国标双重映射 - 🔴 风险

它能做什么

生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清单。 核心能力: - 🛡️ 生成式 AI 服务场景自动识别(大模型/智能对话/AIGC 等关键词触发) - ✅ 5 维度合规检查:备案登记、训练数据、内容安全、用户权益、标识义务 - 📐 办法 + 配套强制国标双重映射 - 🔴 风险分级裁决(high / medium / low) - 🛡️ 否定前缀检测("未备案"不会误判为"已备案") - 📋 合规缺陷清单 + 建议动作输出 - ⚖️ 完全基于中国公开法规 + 强制性国家标准 触发关键词:生成式AI合规、大模型合规、AI服务备案、训练数据合规、 内容安全、算法备案、深度合成标识、AIGC合规 适用范围:提供生成式 AI 服务的中国企业 运行模式:纯本地,零网络请求 外部依赖:Python 标准库(无需额外安装) 本产品为免费护栏,纯本地运行,零网络请求,文本输入即可评估。

技能文档

🛡️ 生成式 AI 服务合规护栏 v1.0.2

概述

ai-gen-guard 是面向生成式 AI 服务的合规护栏。当 Agent 处理涉及生成式 AI 服务(大模型、智能对话、AIGC 平台等)的场景时,护栏实时评估该服务是否符合 《生成式人工智能服务管理暂行办法》及配套强制国标的要求,并按风险等级输出裁决结果。

法规背景

2023年7月10日,国家网信办、国家发改委、教育部、科技部、工信部、公安部、广电总局 联合发布《生成式人工智能服务管理暂行办法》(令第15号),自2023年8月15日起施行。 2025年11月,配套的强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》 正式实施,对训练数据、内容安全、用户权益等提出具体技术指标。

该办法要求:具有舆论属性或社会动员能力的生成式 AI 服务需开展安全评估并履行 算法备案;训练数据须合法来源、尊重知识产权、取得个人信息同意;对违法内容拒答 并处置;与使用者签订服务协议、防范未成年人沉迷;对生成内容按深度合成规定做标识。

本护栏免费使用,纯本地运行,零网络请求,文本输入即可评估。

快速开始

# 评估一段生成式AI服务场景描述
python3 scripts/guard.py --text "我们的生成式AI服务还没有做算法备案"

# 交互模式
python3 scripts/guard.py --interactive

# JSON 格式输出(供 Agent 程序化调用)
python3 scripts/guard.py --text "..." --json

# 从文件读取
cat scenario.txt | python3 scripts/guard.py

合规检查维度(5 项)

#检查项依据法规配套国标
1备案与登记《暂行办法》第十七条安全评估与备案要求
2训练数据合规《暂行办法》第七、八条训练数据安全要求
3内容安全《暂行办法》第四、十四、十五条内容安全要求
4用户权益保护《暂行办法》第九、十、十一条用户权益保护要求
5标识义务《暂行办法》第十二条联动 ai-label 系列

输出示例

{
  "risk_level": "high",
  "summary": "检测到生成式AI服务合规相关信号 (2项关键词触发),合规检查: 0/5 项通过",
  "checks": [
    {
      "id": "filing_registration",
      "label": "备案与登记",
      "regulation": "《暂行办法》第十七条",
      "standard_ref": "GB 强制国标 安全评估与备案要求",
      "status": "fail",
      "detail": "检测到合规缺失信号: 未备案"
    }
  ],
  "suggested_actions": [
    "建议对照《生成式人工智能服务管理暂行办法》及配套强制国标进行正式合规评估",
    "🔴 【备案与登记】《暂行办法》第十七条:检测到合规缺失信号: 未备案"
  ]
}

Agent 使用指南

触发条件

当用户描述以下场景时,Agent 应调用本护栏进行评估:

  • 生成式 AI 服务(大模型/智能对话/AIGC)的上线、备案、合规自查
  • 训练数据的合法来源、知识产权、个人信息同意问题
  • AI 内容安全、违法内容拒答、投诉举报机制
  • 用户协议、未成年人防沉迷、个人信息保护
  • 生成内容的标识义务(联动 ai-label 系列)

使用方式

python3 scripts/guard.py --text "用户描述的场景文本" --json

Agent 解析 JSON 输出中的 risk_levelsuggested_actions,向用户展示评估结果。

案例

用户: 我们做了一个面向公众的大模型对话产品,要不要备案?

Agent: 让我用生成式 AI 服务合规护栏评估一下这个场景。

Agent → ai-gen-guard --text "面向公众的大模型对话产品"
      [护栏返回 risk_level: high, fail: 未备案]

Agent: ⚠️ 根据评估结果,这个场景存在合规风险:
      - 🔴 备案与登记(《暂行办法》第十七条):具有舆论属性/社会动员能力的大模型需安全评估+算法备案
      - 建议:先确认是否具有舆论属性,如具备则开展安全评估并履行算法备案

      如需更全面的结构化检查,可使用同系列的进阶合规检查工具。

文件结构

ai-gen-guard/
├── SKILL.md
├── package.json
├── _meta.json
├── requirements.txt
└── scripts/
    ├── guard.py                      # 主入口
    └── core/
        ├── __init__.py
        ├── rules.py                  # 合规规则库(5维度)
        └── detector.py               # 检测引擎(含否定前缀检测)

参考法规与标准

  • 《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行)
  • 《网络安全技术 生成式人工智能服务安全基本要求》(强制性国家标准,2025年11月实施)
  • 《互联网信息服务深度合成管理规定》(2023年1月10日施行)
  • 《互联网信息服务算法推荐管理规定》(2022年3月1日施行)

⚠️ 重要法律声明

免责条款

使用本技能前请仔细阅读以下条款

1. 非法律建议

本技能提供的信息仅供参考,不构成法律建议、法律意见或专业法律咨询。用户应咨询合格律师获取正式法律意见。本技能的输出结果不具备法律效力,不得作为合规证明或监管呈报材料。

2. 准确性免责

虽然我们尽力确保信息的准确性,但法律法规和配套国家标准可能随时变更,本技能不保证内容与最新法规完全一致。具体技术实施应以最新版配套国家标准为准。

3. 无保证声明

本技能按"原样"(AS IS)提供,不作任何明示或暗示的保证,包括但不限于适销性、特定用途适用性、不侵权或内容的准确性。

4. 责任限制

在法律允许的最大范围内,开发者对使用或无法使用本技能产生的任何损失不承担责任

数据安全说明

本技能纯本地运行,零网络请求,所有输入文本仅保留在内存中,不会上传、存储或持久化。

使用限制

  • 允许:合规自查辅助、风险评估参考、企业内部合规参考
  • 禁止:替代专业法律咨询、作为法律证据提交监管部门、规避法律义务、删除本声明后分发

版本

当前版本:v1.0.2

相关技能

GDPR 合规护栏 (gdpr) v1.0.0。 在 AI 应用输入/输出链路中实时检测 GDPR 语境下的个人数据, 按风险分级脱敏或阻断,供 Agent 主动调用。 Use when: 需要在 Agent 处理用户输入或返回结果前,实时拦截/脱敏 EU 个人数据;防止 IBAN、UK NI、信用卡、特殊类别数据(基因/生物 识别/健康/宗教信仰等)流入大模型或被输出泄露;为 AI 应用加装 符合 GDPR 的运行时护栏。 核心能力: - 🛡️ 实时检测 IBAN、UK NI、EU 电话、信用卡(Luhn)、 IPv4/MAC、邮箱等结构化个人数据 - 🧩 关键词线索识别:GDP

个人信息保护合规护栏。在隐私政策、用户协议、App权限申请、数据收集告知、营销推送文案发布前,实时检测是否符合《个人信息保护法》《数据安全法》《网络安全法》及GB/T 35273等规范要求,拦截不合规内容并给出修改建议。

1 次安装

电商广告合规护栏 (shop-ad-guard) v1.0.0。 在商品标题、详情页、直播话术、促销文案发布前,实时检测高频违规用语, 按风险分级输出命中与整改建议,供 Agent 主动调用。区别于事后深度审计,这是事前拦截。 Use when: 需要在发布电商文案(标题/详情/直播话术/促销)前,实时拦截 绝对化用语、医疗功效违规宣称、虚假夸大、虚假促销、比较贬低、迷信诱导等 高频违规表达;防止触碰《广告法》第九条(罚款 20 万起)、第十七条等红线; 为商家/运营/主播加装一道轻量实时合规护栏。 核心能力: - 🛡️ 实时检测 6 类高频违规用语:绝对化用语 / 医疗功效宣称 / 虚

内容合规审核守卫(v25.0合并content-compliance-checker),三级审核(敏感词→AI语义→平台规则)+U19管道合规步骤(委托risk-detector 10类风险检测)。触发:内容审核/合规检查/敏感词检测/发布前审核/文案审核/U19/风控检查 不触发:内容发布/内容生成/价格调整

2 次安装

招投标合规护栏。在投标文书、招标公告、资格预审文件、中标公示、商务应答、企业宣传发布前,实时检测串通投标/围标、虚假资质业绩、诋毁竞争对手、报价操纵、商业贿赂、排斥性条款等高频违法违规表述,按风险分级输出命中与整改建议。纯本地运行,零网络、零动态执行。

金融消保合规护栏 (finance-consumer-guard) v1.0.0。 在银行理财 / 保险 / 基金 / 资管等金融产品的营销文案、销售话术、广告投放、官网介绍、 对外宣传发布前,实时检测"保本保收益(刚兑)、收益承诺夸大、风险弱化误导、 过往业绩误导、无资质代客理财、广告极限词"相关的高频违规 / 高风险表述, 按风险分级输出命中与整改建议,供 Agent 主动调用。区别于事后深度审计,这是事前拦截。 Use when: 需要在金融产品营销文案、销售话术、广告、官网介绍、对外宣传发布前, 实时拦截"保本保收益 / 稳赚不赔 / 低风险高收益 / 代客理财 / 最佳理财"等高频