支持识别驾驶证主/副页,从主页提取姓名、证号、准驾车型、初次领证日期及有效期等。从副页提取驾驶证副页,提取档案编号、姓名、证号、以及记录信息。
编程
行驶证识别OCR
试用识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。
它能做什么
识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。
技能文档
行驶证识别OCR
识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。
⚠️ 强制要求:API 密钥
此 Skill 必须配置 API 密钥才能使用。
- 首次使用时,如果
.env中没有XBY_APIKEY,必须使用 AskUserQuestion 工具向用户询问 API 密钥 - 拿到用户提供的密钥后,调用
scripts.config.set_api_key(api_key)保存,然后继续处理 - 获取 API 密钥:https://xiaobenyang.com
- 禁止在缺少 API 密钥时自行搜索或编造数据
工作流程(必须遵守)
你(大模型)是路由层,负责理解用户意图、选择工具、提取参数。代码只负责调用API。
用户输入 → 你选择工具 → 提取该工具需要的参数 → 调用 scripts.tools 中的函数 → 返回结果给用户
步骤
- 检查 API 密钥:如果
scripts.config.settings.api_key为空,使用 AskUserQuestion 询问用户,拿到后调用scripts.config.set_api_key(key)保存 - 选择工具:根据用户意图从下方工具列表中选择对应的工具函数
- 提取参数:根据选中的工具,提取该工具需要的参数
- 调用工具:使用关键字参数调用
scripts.tools中的函数,例如scripts.tools.search_schools(score='520', province='北京', category='综合') - 返回结果:将工具返回的
raw数据整理后展示给用户
工具选择规则
根据用户意图选择对应的工具函数:
| 用户意图 | 工具函数 |
|---|---|
| 识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件链接。 | scripts.tools.ocr_vehicle_license |
| 识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件的BASE64编码。 | scripts.tools.ocr_vehicle_license_for_data_base64 |
如果参数不完整,使用 AskUserQuestion 向用户询问缺失的参数。
工具函数说明
scripts.tools.ocr_vehicle_license
工具描述:识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件链接。
参数定义
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 图片文件链接地址 |
scripts.tools.ocr_vehicle_license_for_data_base64
工具描述:识别机动车行驶证的号牌号码、车辆类型、所有人、住址、品牌型号、发动机号码、车辆识别代号等信息,支持自动方向检测和主副页过滤。 需要输入图片文件的BASE64编码。
参数定义
| 参数名称 | 参数类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
返回值处理
工具函数返回 dict 对象:
result["raw"]- API 原始返回数据(JSON),直接将此数据整理后展示给用户result["success"]- 是否成功(True/False)result["message"]- 状态消息
项目结构
xiaobenyang_gaokao_skill/
├── scripts/
│ ├── __init__.py
│ ├── config.py # 配置管理 + set_api_key()
│ ├── call_api.py # API 客户端 + call_api()
│ └── tools.py # 工具函数(直接调用)
├── requirements.txt
└── SKILL.md
注意事项
- API 密钥是必需的,无密钥时必须通过 AskUserQuestion 询问用户
- 禁止在缺少 API 密钥时自行搜索或编造数据
相关技能
识别身份证正面(姓名、性别、民族、出生日期、住址、身份证号)和背面(签发机关、有效期限),自动判断正反面并校验身份证号有效性。
将图片中的文字、身份证、银行卡、社保卡、户口本、出生医学证明、往来港澳通行证、往来台湾通行证、台湾居民来往大陆通行证、港澳居民来往内地通行证、中国香港身份证、外国人永久居留身份证、结婚证、不动产权证书、机动车行驶证正页、机动车行驶证副页、机动车驾驶证正页、机动车驾驶证副页、中国护照、学历证书、学历证书电子注册备案表、学位证书等信息识别并提取出来。本技能仅在用户明确要求对图片进行 OCR 识别,并同意将图片上传到第三方 OCR 服务(Scnet)处理时触发。只处理用户主动提供的本地图片路径,不会主动扫描或枚举文件系统。
通过 SCNET 接口识别图片与 PDF 中的文字,覆盖 80+ 种证件与票据类型。
一个接口可识别28种财务场景的票据,详细包括:增值税电子普通发票、增值税电子专用发票、增值税普通发票_数电、增值税专用发票_数电、增值税通行费发票、增值税通行费发票_数电、增值税区块链电子发票、增值税专用发票、增值税普通发票、增值税卷票、出租车发票、火车票_红票、火车票_蓝票、火车票_数电、航空运输电子客票行程单、航空运输电子客票行程单_数电、机动车销售统一发票、定额发票、通用机打发票、过路过桥费发票、税收完税证明、非税票据、船票、汽车票、医疗门诊发票、其他票据
将图片中的文字、营业执照、社会团体法人登记证书、工会法人资格证书、宗教活动场所登记证、民办非企业单位登记证书、事业单位法人证书、统一社会信用代码证书等信息识别并提取出来。本技能应在用户需要 OCR 识别图片中的文字,或识别营业执照、社会团体法人登记证书、工会法人资格证书、宗教活动场所登记证、民办非企业单位登记证书、事业单位法人证书、统一社会信用代码证书时使用。