GDPR 合规护栏 (gdpr) v1.0.0。 在 AI 应用输入/输出链路中实时检测 GDPR 语境下的个人数据, 按风险分级脱敏或阻断,供 Agent 主动调用。 Use when: 需要在 Agent 处理用户输入或返回结果前,实时拦截/脱敏 EU 个人数据;防止 IBAN、UK NI、信用卡、特殊类别数据(基因/生物 识别/健康/宗教信仰等)流入大模型或被输出泄露;为 AI 应用加装 符合 GDPR 的运行时护栏。 核心能力: - 🛡️ 实时检测 IBAN、UK NI、EU 电话、信用卡(Luhn)、 IPv4/MAC、邮箱等结构化个人数据 - 🧩 关键词线索识别:GDP
安全
AI Gen Guard -生成式 AI 服务合规护栏
试用生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清单。 核心能力: - 🛡️ 生成式 AI 服务场景自动识别(大模型/智能对话/AIGC 等关键词触发) - ✅ 5 维度合规检查:备案登记、训练数据、内容安全、用户权益、标识义务 - 📐 办法 + 配套强制国标双重映射 - 🔴 风险
它能做什么
生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清单。 核心能力: - 🛡️ 生成式 AI 服务场景自动识别(大模型/智能对话/AIGC 等关键词触发) - ✅ 5 维度合规检查:备案登记、训练数据、内容安全、用户权益、标识义务 - 📐 办法 + 配套强制国标双重映射 - 🔴 风险分级裁决(high / medium / low) - 🛡️ 否定前缀检测("未备案"不会误判为"已备案") - 📋 合规缺陷清单 + 建议动作输出 - ⚖️ 完全基于中国公开法规 + 强制性国家标准 触发关键词:生成式AI合规、大模型合规、AI服务备案、训练数据合规、 内容安全、算法备案、深度合成标识、AIGC合规 适用范围:提供生成式 AI 服务的中国企业 运行模式:纯本地,零网络请求 外部依赖:Python 标准库(无需额外安装) 本产品为免费护栏,纯本地运行,零网络请求,文本输入即可评估。
技能文档
🛡️ 生成式 AI 服务合规护栏 v1.0.2
概述
ai-gen-guard 是面向生成式 AI 服务的合规护栏。当 Agent 处理涉及生成式 AI 服务(大模型、智能对话、AIGC 平台等)的场景时,护栏实时评估该服务是否符合 《生成式人工智能服务管理暂行办法》及配套强制国标的要求,并按风险等级输出裁决结果。
法规背景
2023年7月10日,国家网信办、国家发改委、教育部、科技部、工信部、公安部、广电总局 联合发布《生成式人工智能服务管理暂行办法》(令第15号),自2023年8月15日起施行。 2025年11月,配套的强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》 正式实施,对训练数据、内容安全、用户权益等提出具体技术指标。
该办法要求:具有舆论属性或社会动员能力的生成式 AI 服务需开展安全评估并履行 算法备案;训练数据须合法来源、尊重知识产权、取得个人信息同意;对违法内容拒答 并处置;与使用者签订服务协议、防范未成年人沉迷;对生成内容按深度合成规定做标识。
本护栏免费使用,纯本地运行,零网络请求,文本输入即可评估。
快速开始
# 评估一段生成式AI服务场景描述
python3 scripts/guard.py --text "我们的生成式AI服务还没有做算法备案"
# 交互模式
python3 scripts/guard.py --interactive
# JSON 格式输出(供 Agent 程序化调用)
python3 scripts/guard.py --text "..." --json
# 从文件读取
cat scenario.txt | python3 scripts/guard.py
合规检查维度(5 项)
| # | 检查项 | 依据法规 | 配套国标 |
|---|---|---|---|
| 1 | 备案与登记 | 《暂行办法》第十七条 | 安全评估与备案要求 |
| 2 | 训练数据合规 | 《暂行办法》第七、八条 | 训练数据安全要求 |
| 3 | 内容安全 | 《暂行办法》第四、十四、十五条 | 内容安全要求 |
| 4 | 用户权益保护 | 《暂行办法》第九、十、十一条 | 用户权益保护要求 |
| 5 | 标识义务 | 《暂行办法》第十二条 | 联动 ai-label 系列 |
输出示例
{
"risk_level": "high",
"summary": "检测到生成式AI服务合规相关信号 (2项关键词触发),合规检查: 0/5 项通过",
"checks": [
{
"id": "filing_registration",
"label": "备案与登记",
"regulation": "《暂行办法》第十七条",
"standard_ref": "GB 强制国标 安全评估与备案要求",
"status": "fail",
"detail": "检测到合规缺失信号: 未备案"
}
],
"suggested_actions": [
"建议对照《生成式人工智能服务管理暂行办法》及配套强制国标进行正式合规评估",
"🔴 【备案与登记】《暂行办法》第十七条:检测到合规缺失信号: 未备案"
]
}
Agent 使用指南
触发条件
当用户描述以下场景时,Agent 应调用本护栏进行评估:
- 生成式 AI 服务(大模型/智能对话/AIGC)的上线、备案、合规自查
- 训练数据的合法来源、知识产权、个人信息同意问题
- AI 内容安全、违法内容拒答、投诉举报机制
- 用户协议、未成年人防沉迷、个人信息保护
- 生成内容的标识义务(联动 ai-label 系列)
使用方式
python3 scripts/guard.py --text "用户描述的场景文本" --json
Agent 解析 JSON 输出中的 risk_level 和 suggested_actions,向用户展示评估结果。
案例
用户: 我们做了一个面向公众的大模型对话产品,要不要备案?
Agent: 让我用生成式 AI 服务合规护栏评估一下这个场景。
Agent → ai-gen-guard --text "面向公众的大模型对话产品"
[护栏返回 risk_level: high, fail: 未备案]
Agent: ⚠️ 根据评估结果,这个场景存在合规风险:
- 🔴 备案与登记(《暂行办法》第十七条):具有舆论属性/社会动员能力的大模型需安全评估+算法备案
- 建议:先确认是否具有舆论属性,如具备则开展安全评估并履行算法备案
如需更全面的结构化检查,可使用同系列的进阶合规检查工具。
文件结构
ai-gen-guard/
├── SKILL.md
├── package.json
├── _meta.json
├── requirements.txt
└── scripts/
├── guard.py # 主入口
└── core/
├── __init__.py
├── rules.py # 合规规则库(5维度)
└── detector.py # 检测引擎(含否定前缀检测)
参考法规与标准
- 《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行)
- 《网络安全技术 生成式人工智能服务安全基本要求》(强制性国家标准,2025年11月实施)
- 《互联网信息服务深度合成管理规定》(2023年1月10日施行)
- 《互联网信息服务算法推荐管理规定》(2022年3月1日施行)
⚠️ 重要法律声明
免责条款
使用本技能前请仔细阅读以下条款:
1. 非法律建议
本技能提供的信息仅供参考,不构成法律建议、法律意见或专业法律咨询。用户应咨询合格律师获取正式法律意见。本技能的输出结果不具备法律效力,不得作为合规证明或监管呈报材料。
2. 准确性免责
虽然我们尽力确保信息的准确性,但法律法规和配套国家标准可能随时变更,本技能不保证内容与最新法规完全一致。具体技术实施应以最新版配套国家标准为准。
3. 无保证声明
本技能按"原样"(AS IS)提供,不作任何明示或暗示的保证,包括但不限于适销性、特定用途适用性、不侵权或内容的准确性。
4. 责任限制
在法律允许的最大范围内,开发者对使用或无法使用本技能产生的任何损失不承担责任。
数据安全说明
本技能纯本地运行,零网络请求,所有输入文本仅保留在内存中,不会上传、存储或持久化。
使用限制
- ✅ 允许:合规自查辅助、风险评估参考、企业内部合规参考
- ❌ 禁止:替代专业法律咨询、作为法律证据提交监管部门、规避法律义务、删除本声明后分发
版本
当前版本:v1.0.2
相关技能
个人信息保护合规护栏。在隐私政策、用户协议、App权限申请、数据收集告知、营销推送文案发布前,实时检测是否符合《个人信息保护法》《数据安全法》《网络安全法》及GB/T 35273等规范要求,拦截不合规内容并给出修改建议。
电商广告合规护栏 (shop-ad-guard) v1.0.0。 在商品标题、详情页、直播话术、促销文案发布前,实时检测高频违规用语, 按风险分级输出命中与整改建议,供 Agent 主动调用。区别于事后深度审计,这是事前拦截。 Use when: 需要在发布电商文案(标题/详情/直播话术/促销)前,实时拦截 绝对化用语、医疗功效违规宣称、虚假夸大、虚假促销、比较贬低、迷信诱导等 高频违规表达;防止触碰《广告法》第九条(罚款 20 万起)、第十七条等红线; 为商家/运营/主播加装一道轻量实时合规护栏。 核心能力: - 🛡️ 实时检测 6 类高频违规用语:绝对化用语 / 医疗功效宣称 / 虚
内容合规审核守卫(v25.0合并content-compliance-checker),三级审核(敏感词→AI语义→平台规则)+U19管道合规步骤(委托risk-detector 10类风险检测)。触发:内容审核/合规检查/敏感词检测/发布前审核/文案审核/U19/风控检查 不触发:内容发布/内容生成/价格调整
招投标合规护栏。在投标文书、招标公告、资格预审文件、中标公示、商务应答、企业宣传发布前,实时检测串通投标/围标、虚假资质业绩、诋毁竞争对手、报价操纵、商业贿赂、排斥性条款等高频违法违规表述,按风险分级输出命中与整改建议。纯本地运行,零网络、零动态执行。
金融消保合规护栏 (finance-consumer-guard) v1.0.0。 在银行理财 / 保险 / 基金 / 资管等金融产品的营销文案、销售话术、广告投放、官网介绍、 对外宣传发布前,实时检测"保本保收益(刚兑)、收益承诺夸大、风险弱化误导、 过往业绩误导、无资质代客理财、广告极限词"相关的高频违规 / 高风险表述, 按风险分级输出命中与整改建议,供 Agent 主动调用。区别于事后深度审计,这是事前拦截。 Use when: 需要在金融产品营销文案、销售话术、广告、官网介绍、对外宣传发布前, 实时拦截"保本保收益 / 稳赚不赔 / 低风险高收益 / 代客理财 / 最佳理财"等高频