编程

Driver License Ocr

试用

支持识别驾驶证主/副页,从主页提取姓名、证号、准驾车型、初次领证日期及有效期等。从副页提取驾驶证副页,提取档案编号、姓名、证号、以及记录信息。

它能做什么

支持识别驾驶证主/副页,从主页提取姓名、证号、准驾车型、初次领证日期及有效期等。从副页提取驾驶证副页,提取档案编号、姓名、证号、以及记录信息。

技能文档

Sugon-Scnet 驾驶证识别 OCR 技能

本技能封装了驾驶证识别的 OCR 服务,通过单一接口即可调用 1 种识别能力,高效提取驾驶证里核心信息。

🚨 重要隐私与安全警告(使用前必读)

1. 数据外传性质
本技能会将您提供的驾驶证图片,通过网络传输至第三方服务商(api.scnet.cn 进行 OCR 处理。图片数据会离开您的本地设备,并非在本地离线处理。

2. 数据的敏感性
机动车驾驶证包含以下高度敏感的个人信息:

  • 个人身份:姓名、证件号码(身份证号)、住址(部分版本)。
  • 驾驶资质:准驾车型、初次领证日期、有效期限、档案编号。
  • 个人照片(部分图片可能包含)。 > 这些信息一旦泄露,可能被用于身份冒用、伪造证件等违法活动。

3. 数据用途与保留

  • 用途:上传的数据仅用于本次文本识别请求,服务商不会用于其他目的。
  • 保留期限:请查阅服务商(scnet.cn)官方隐私政策。建议您在获取识别结果后,立即手动删除本地图片及任何缓存副本,以降低数据暴露风险。

4. 法律合规与授权
使用本技能处理非本人的驾驶证时,您必须确保已获得该证件信息主体的明确授权。未经授权处理他人个人信息可能违反《个人信息保护法》等相关法律法规。

5. 用户知情同意
使用本技能即表示您已阅读、理解并同意上述数据处理方式,并自愿承担因不当使用、未授权处理或数据泄露所引发的一切法律责任。


功能特性

  • 驾驶证识别:支持识别行驶证主页和副页信息·,从主页提取提取号牌号码、所有人、品牌型号、车架号及发动机号等。从副页提取档案编号、核定载人数、总质量及检验记录等。

前置配置

⚠️ 重要:使用前需要申请 Scnet API Token

申请 API Token

  1. 访问 Scnet 官网 注册/登录
  2. 在控制台申请 API 密钥(格式:sc-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx
  3. 复制密钥备用

配置 Token

手动配置(推荐)

  1. 在技能目录下创建 config/.env 文件,内容如下:
# =====  Sugon-Scnet OCR API 配置 =====
# 申请地址:https://www.scnet.cn
SCNET_API_KEY=your_scnet_api_key_here

# API 基础地址(一般无需修改)
SCNET_API_BASE=https://api.scnet.cn/api/llm/v1
  1. 添加:SCNET_API_KEY=你的密钥
  2. 设置文件权限为 600(仅所有者可读写) ⚠️ 安全警告:切勿将 API Key 直接粘贴到聊天对话中,否则可能被记录或泄露。

Token 更新

Token 过期后调用会返回 401 或 403 错误。更新方法:重新申请 Token 并替换 config/.env 中的 SCNET_API_KEY。

依赖安装

本技能需要 Python 3.6+ 和 requests 库。请运行以下命令:

   pip install requests

使用方法

参数说明

参数名类型必填描述
ocrTypestring识别类型枚举。必须为以下之一:• MOTOR_VEHICLE_DRIVING_LICENSE(机动车驾驶证正页)• MOTOR_VEHICLE_DRIVING_LICENSE_SU(机动车驾驶证副页)
filePathstring待识别图片的本地绝对路径。支持 jpg、png、pdf 等常见格式。

命令行调用示例

   python .claude/skills/driver_license_ocr/scripts/main.py MOTOR_VEHICLE_DRIVING_LICENSE /path/to/test.jpg

在 AI 对话中使用

用户可以说:

  • “帮我识别这张图像中的驾驶证信息,图片在 /Users/name/Downloads/test.jpg”

AI 会根据 description 中的关键词自动触发本技能。

AI 调用建议

为避免触发 API 速率限制(10 QPS),请串行调用本技能,即等待前一个识别完成后再发起下一个请求。 如果使用 OpenClaw 的 exec 工具,建议设置 timeout 或 yieldMs 参数,让命令同步执行,避免多个命令同时运行导致并发。

配置选项

编辑 config/.env 文件:

变量名默认值说明
SCNET_API_KEY必需Scnet API 密钥
SCNET_API_BASEhttps://api.scnet.cn/api/llm/v1API 基础地址(一般无需修改)

输出

  • 标准输出:识别结果的 JSON 数据,结构与 API 文档一致,位于 data 字段内。
  • 识别结果位于 data[0].result[0].elements 中,具体字段取决于 ocrType。
  • 错误信息:如果发生错误,会输出以 错误: 开头的友好提示。

注意事项

  • 本技能调用的 OCR API 有 10 QPS 的速率限制。
  • 如果遇到 429 错误,请等待 2-3 秒后重试,不要连续发起请求。
  • 建议在调用前确保图片已准备就绪,避免因网络问题导致重复调用。

故障排除

问题解决方案
配置文件不存在创建 config/.env 并填入 Token(参考前置配置)
API Key 无效/过期重新申请 Token 并更新 .env 文件
文件不存在检查提供的文件路径是否正确
网络连接失败检查网络连接或防火墙设置
不支持的文件类型确保文件扩展名为允许的类型(参考 API 文档)
401/403/UnauthorizedToken 无效或过期,重新申请并配置
429 Too Many Requests请求过于频繁,技能会自动等待并重试(最多 3 次)。若持续失败,请降低调用频率或联系服务方提高限额。

相关技能

识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。

将图片中的文字、身份证、银行卡、社保卡、户口本、出生医学证明、往来港澳通行证、往来台湾通行证、台湾居民来往大陆通行证、港澳居民来往内地通行证、中国香港身份证、外国人永久居留身份证、结婚证、不动产权证书、机动车行驶证正页、机动车行驶证副页、机动车驾驶证正页、机动车驾驶证副页、中国护照、学历证书、学历证书电子注册备案表、学位证书等信息识别并提取出来。本技能仅在用户明确要求对图片进行 OCR 识别,并同意将图片上传到第三方 OCR 服务(Scnet)处理时触发。只处理用户主动提供的本地图片路径,不会主动扫描或枚举文件系统。

22 次安装

识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。

支持金融单据识别,支持识别多种金融单据,包括银行承兑汇票、电子银行承兑汇票、商业承兑汇票、电子商业承兑汇票、银行支票、银行回单、进账单、电汇凭证、支款凭证、移动支付账单、财政授权支付凭证、海关专用缴款书、海关进/出口货物报关单、国际汇票、商业发票、原产地证明、货物运输保险单、装箱单、提单,结构化提取关键信息。

8 次安装

通过 SCNET 接口识别图片与 PDF 中的文字,覆盖 80+ 种证件与票据类型。

27 次安装

仅在用户明确提及“银行支票”、“支票号码”、“支票金额”、“支票识别”等特定词汇时触发,用于识别银行支票上的关键信息(号码、日期、大小写金额、签章等)。不适用于通用 OCR 或非支票类图像识别。

8 次安装