编程

TencentCloud MLIDPassport OCR

试用

腾讯云护照识别(多国多地区)(MLIDPassportOCR)接口调用技能。当用户需要识别护照图片中中国大陆、港澳台地区或其他国家/地区的护照信息(护照ID、姓名、出生日期、性别、有效期、发行国、国籍、国家地区代码、MRZ码等)时,应使用此技能。支持图片Base64和URL两种输入方式,支持护照图片人像照片裁剪功...

它能做什么

调用腾讯云OCR护照识别接口,支持中国大陆地区及中国港澳台地区、其他国家以及地区的护照识别,覆盖80+国家/地区的可机读护照。

技能文档

腾讯云护照识别(多国多地区)(MLIDPassportOCR)

用途

调用腾讯云OCR护照识别接口,支持中国大陆地区及中国港澳台地区、其他国家以及地区的护照识别,覆盖80+国家/地区的可机读护照。

核心能力:

  • 机读码区(MRZ)解析:识别护照ID、姓名(姓/名)、出生日期、性别、有效期、发行国、国籍、国家地区代码、类型、MRZ Code序列
  • 信息区(VRZ)解析:识别证件类型、发行国家、护照号码、姓、名、姓名、国籍、出生日期、性别、发行日期、截止日期、持证人签名(仅中国大陆护照)、签发地点(仅中国大陆护照)、签发机关(仅中国大陆护照)
  • 人像裁剪:支持返回护照人像照片Base64(需设置RetImage=true)
  • 告警功能(仅国际站生效):边框不完整、复印件、翻拍、PS、反光、模糊等6种告警检测

官方文档:https://cloud.tencent.com/document/api/866/37657

使用时机

当用户提出以下需求时触发此技能:

  • 需要从护照图片中提取证件信息
  • 需要识别护照上的姓名、护照号、国籍、出生日期等字段
  • 需要解析护照的MRZ机读码信息
  • 需要裁剪护照上的人像照片
  • 需要检测护照是否为复印件、翻拍件、PS件(国际站)
  • 涉及护照OCR识别的任何场景
  • 涉及多国多地区护照识别的场景

环境要求

  • Python 3.6+
  • 依赖:tencentcloud-sdk-python(通过 pip install tencentcloud-sdk-python 安装)
  • 环境变量:
    • TENCENTCLOUD_SECRET_ID:腾讯云API密钥ID
    • TENCENTCLOUD_SECRET_KEY:腾讯云API密钥Key

使用方式

运行 scripts/main.py 脚本完成护照识别。

请求参数

参数类型必填说明
ImageBase64str否(二选一)图片Base64值,编码后不超过10M,分辨率建议500*800以上,支持PNG/JPG/JPEG/BMP/PDF,建议卡片部分占图片2/3以上
ImageUrlstr否(二选一)图片URL地址,下载时间不超过3秒,都提供时只使用ImageUrl
RetImagebool是否返回人像照片Base64,默认false
UserAgentstr请求来源标识(可选),用于追踪调用来源,统一固定为Skills

输出格式

识别成功后返回 JSON 格式结果:

{
  "ID": "456712345",
  "Name": "CARTER ESTHER",
  "Surname": "CARTER",
  "GivenName": "ESTHER",
  "DateOfBirth": "19900411",
  "Sex": "F",
  "DateOfExpiration": "20210726",
  "IssuingCountry": "USA",
  "Nationality": "USA",
  "Type": "P",
  "CodeSet": "P 注:WarnCardInfos 仅在国际站请求时生效,国内站固定返回空数组。Warn 和 AdvancedInfo 字段已废弃,不建议使用。

### 错误码说明

| 错误码 | 描述 |
|--------|------|
| FailedOperation.DownLoadError | 文件下载失败 |
| FailedOperation.FieldException | 字段值不符合预期 |
| FailedOperation.ImageDecodeFailed | 图片解码失败 |
| FailedOperation.InconsistencyBetweenMRZAndVRZ | 视读区信息与机读区信息不一致 |
| FailedOperation.NoPassport | 非护照 |
| FailedOperation.OcrFailed | OCR识别失败 |
| FailedOperation.UnKnowError | 未知错误 |
| FailedOperation.UnOpenError | 服务未开通 |
| FailedOperation.WarningServiceFailed | 通用告警服务异常 |
| InvalidParameterValue.InvalidParameterValueLimit | 参数值错误 |
| LimitExceeded.TooLargeFileError | 文件内容太大 |
| ResourceUnavailable.InArrears | 账号已欠费 |
| ResourceUnavailable.ResourcePackageRunOut | 账号资源包耗尽 |
| ResourcesSoldOut.ChargeStatusException | 计费状态异常 |

### 业务逻辑说明

1. ImageBase64 和 ImageUrl 必须提供其一,都提供时只使用 ImageUrl
2. 支持自动将 PDF 第1页转为图片进行识别
3. 区分国内版和国际版(通过地域配置),解析逻辑不同
4. 泰国护照(IssuingCountry=="THA")会自动校验OCR区和MRZ区字段一致性(姓名、护照号、性别、日期等)
5. Warn 和 AdvancedInfo 字段已废弃,固定返回空数组和"1",不建议使用
6. WarnCardInfos 仅国际站请求生效,国内站固定返回空数组
7. CardCount 字段仅在请求曼谷地域(ap-bangkok)时返回
8. PassportRecognizeInfos 中的 Signature、IssuePlace、IssuingAuthority 仅在中国大陆护照时返回有效值
9. 默认接口请求频率限制:5次/秒

### 调用示例

```bash
# 通过URL识别护照
python scripts/main.py --image-url "https://example.com/passport.jpg"

# 通过URL识别护照并返回人像照片
python scripts/main.py --image-url "https://example.com/passport.jpg" --ret-image

# 通过Base64识别护照
python scripts/main.py --image-base64 "/path/to/passport.jpg"

# 指定地域(如使用国际站获取告警信息)
python scripts/main.py --image-url "https://example.com/passport.jpg" --region ap-bangkok

# 输出原始API响应(不格式化)
python scripts/main.py --image-url "https://example.com/passport.jpg" --raw```

相关技能

诊断生产力系统反复失效的根因,给出最小干预——容量测算、瓶颈定位、可靠的本地记录。

作者 Iván854 次安装69 星标

按用户明确指令,在得到大脑(Get笔记)中保存、搜索并管理笔记与知识库。

作者 iswalle763 次安装66 星标

把 API 文档、OpenAPI 规范或现有脚本变成 Codex 可直接调用的命令行工具。

作者 OpenAI27.5k 星标

引导你完成技能撰写、评估运行与迭代改进的完整闭环。

作者 Anthropic177.2k 星标

figma-use

官方

在 Figma 文件中执行 JavaScript,以编程方式创建和修改节点、组件、变量和布局。

作者 OpenAI27.5k 星标

按 Microsoft 现行文档规范构建 ASP.NET Core 应用:选对模型、用现代宿主、走官方推荐写法。

作者 OpenAI27.5k 星标

zt1314p-design 的更多技能

浏览全部技能

腾讯云试题批改Agent(SubmitQuestionMarkAgentJob/DescribeQuestionMarkAgentJob)接口调用技能。当用户需要对试卷图片或试题图片中的K12试卷或试题进行自动批改、手写答案识别、知识点分析时,应使用此技能。支持整卷图片批改和单题图片批改,提供题目切题、正误判定、...

作者 zt1314p-design28 次安装

腾讯云通用票据识别高级版(VatInvoiceOCR)接口调用技能。当用户需要识别发票图片中增值税专用发票、增值税普通发票、增值税电子专票、增值税电子普票、电子发票(普通/增值税专用)的全字段信息时,应使用此技能。支持识别发票图片中的发票代码、发票号码、开票日期、合计金额、校验码、税率、合计税额、价税合计、购买方...

作者 zt1314p-design24 次安装

腾讯云实时文档抽取Agent(ExtractDocAgent)接口调用技能。当用户需要从图片或PDF中按自定义字段名称进行结构化信息抽取时,应使用此技能。支持自定义字段名称、字段类型(KV对或表格字段)和字段提示词,实现灵活的文档信息提取。适用于合同、发票、报告等各类文档的结构化数据抽取场景。

作者 zt1314p-design27 次安装

腾讯云通用文字识别(高精度版)(GeneralAccurateOCR) 技能包。当用户发送/粘贴图片、提供图片URL、或要求识别图片中的文字时,应自动调用此技能。支持图像整体文字的检测和识别,支持中文、英文、中英文、数字和特殊字符号的识别,并返回文字框位置和文字内容。适用于文字较多、版式复杂、对识别准召率要求较高...

作者 zt1314p-design60 次安装1 星标

腾讯云表格识别v3(RecognizeTableAccurateOCR)接口调用技能。当用户需要从表格图片或PDF中识别常规表格、无线表格、多表格的内容,提取每个单元格的文字信息,或将表格图片识别结果导出为Excel文件时,应使用此技能。支持中英文表格图片、旋转表格图片、嵌套表格图片等复杂场景,识别效果优于表格识...

作者 zt1314p-design32 次安装

企业财报三表(资产负债表 / 利润表 / 纳税申报表)勾稽检查技能包。当用户上传财报PDF/图片、或要求进行财报审核、三表勾稽校验时,应自动调用此技能。支持从财报PDF/图片中结构化抽取三表关键数据,自动统一单位(万元)与币种(必要时按实时汇率折算为CNY),执行时间一致性/字段完整性/核心税会差异/跨表校验,并...

作者 zt1314p-design12 次安装