{"id":"ee9e9026-c254-4379-ab2d-b81ffb712e08","entityType":"agent","slug":"clawhub-yescan-ai-alibaba-quark-ocr","name":"夸克扫描王 - OCR文字识别 Alibaba-Quark-OCR","canonicalUrl":"https://www.xpersona.co/agent/clawhub-yescan-ai-alibaba-quark-ocr","canonicalPath":"/agent/clawhub-yescan-ai-alibaba-quark-ocr","generatedAt":"2026-10-11T14:16:20.322Z","source":"CLAWHUB","claimStatus":"UNCLAIMED","verificationTier":"NONE","summary":{"evidence":{"source":"editorial-content","verified":true,"confidence":"high","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":null},"description":"由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务 Skill: 夸克扫描王 - OCR文字识别 Alibaba-Quark-OCR Owner: yescan-ai Summary: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务 Tags: latest:1.0.12 Version history: v1.0.12 | 2026-07-10T08:17:55.148Z | user - 简化和调整了 descripti","descriptionLabel":"Technical summary","evidenceSummary":"Capability contract not published. No trust telemetry is available yet. 1.1K downloads reported by the source. Last updated 10/11/2026.","installCommand":"clawhub skill install s17cpsmkvb7rwpbns3vsexnv0n882f2y:alibaba-quark-ocr","sourceUrl":"https://clawhub.ai/yescan-ai/alibaba-quark-ocr","homepage":"https://clawhub.ai/yescan-ai/skills/alibaba-quark-ocr","primaryLinks":[{"label":"View on ClawHub","url":"https://clawhub.ai/yescan-ai/alibaba-quark-ocr","kind":"source"},{"label":"Homepage","url":"https://clawhub.ai/yescan-ai/skills/alibaba-quark-ocr","kind":"homepage"}],"safetyScore":84,"overallRank":62,"popularityScore":61,"trustScore":null,"claimedByName":null,"isOwner":false,"seoDescription":"由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。"},"coverage":{"evidence":{"source":"public-profile","verified":false,"confidence":"medium","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":null},"protocols":[{"protocol":"OPENCLEW","label":"OpenClaw","status":"self-declared","notes":"Declared in the public agent profile."}],"capabilities":[],"verifiedCount":0,"selfDeclaredCount":1,"capabilityMatrix":{"rows":[{"key":"OPENCLEW","type":"protocol","support":"unknown","confidenceSource":"profile","notes":"Listed on profile"}],"flattenedTokens":"protocol:OPENCLEW|unknown|profile"}},"adoption":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"medium","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":null},"stars":null,"forks":null,"downloads":1086,"packageName":null,"latestVersion":"1.0.12","tractionLabel":"1.1K downloads"},"release":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"medium","updatedAt":"2026-10-11T10:34:21.036Z","emptyReason":null},"lastUpdatedAt":"2026-10-11T10:34:21.107Z","lastCrawledAt":"2026-10-11T10:34:21.036Z","lastIndexedAt":null,"nextCrawlAt":"2026-10-12T10:34:21.036Z","lastVerifiedAt":null,"highlights":[{"version":"1.0.12","createdAt":"2026-07-10T08:17:55.148Z","changelog":"- 简化和调整了 description 描述文本，使用途更通用、提及自动触发条件，并补充了“不适用”场景说明。 - 移除了不必要的元信息和文档文件：_meta.json、skill-card.md。 - 更新了 CLI 配置示例命令中的 skill 名称字段（yescan-ocr-universal → alibaba-quark-ocr）。 - 其余技能执行逻辑、场景匹配规则和接口规范未作变动。","fileCount":12,"zipByteSize":19309},{"version":"1.0.0","createdAt":"2026-07-09T07:28:27.264Z","changelog":"alibaba-quark-ocr 1.0.0 - 首次发布，集成夸克扫描王高精准 OCR 文字识别能力。 - 支持印刷、手写、表格、证件、票据、公式、商品图片等多种复杂场景。 - 严格按照单一意图原则，自动匹配17类常见图片 OCR 场景。 - 稳定支持图片 URL、本地文件、Base64 三种输入方式。 - 明确数据隐私与外部 API 调用提示，环境变量配置简明易用。","fileCount":12,"zipByteSize":19155},{"version":"1.0.11","createdAt":"2026-07-08T14:58:12.871Z","changelog":"- Skill renamed from \"yescan-ocr-universal\" to \"alibaba-quark-ocr\" - Description updated to further emphasize multi-language, print, handwriting and formula scenarios - No changes to functionality or procedural instructions - Initial metadata file (_meta.json) added","fileCount":12,"zipByteSize":18971},{"version":"1.0.10","createdAt":"2026-07-08T14:48:16.487Z","changelog":"- Skill renamed from \"yescan-ocr-universal\" to \"alibaba-quark-ocr\" - Added metadata file (_meta.json); removed skill-card.md - SKILL.md now includes a more concise, improved description - No structural changes to usage, intent mapping, commands, or capabilities - Internal and external documentation updated for clarity and branding","fileCount":11,"zipByteSize":17785}]},"execution":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No published capability contract is available yet."},"installCommand":"clawhub skill install s17cpsmkvb7rwpbns3vsexnv0n882f2y:alibaba-quark-ocr","setupComplexity":"low","setupSteps":["Setup complexity is LOW. This package is likely designed for quick installation with minimal external side-effects.","Final validation: Expose the agent to a mock request payload inside a sandbox and trace the network egress before allowing access to real customer data."],"contract":{"contractStatus":"missing","authModes":[],"requires":[],"forbidden":[],"supportsMcp":false,"supportsA2a":false,"supportsStreaming":false,"inputSchemaRef":null,"outputSchemaRef":null,"dataRegion":null,"contractUpdatedAt":null,"sourceUpdatedAt":null,"freshnessSeconds":null},"invocationGuide":{"preferredApi":{"snapshotUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/snapshot","contractUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/contract","trustUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/trust"},"curlExamples":["curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/snapshot\"","curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/contract\"","curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/trust\""],"jsonRequestTemplate":{"query":"summarize this repo","constraints":{"maxLatencyMs":2000,"protocolPreference":["OPENCLEW"]}},"jsonResponseTemplate":{"ok":true,"result":{"summary":"...","confidence":0.9},"meta":{"source":"CLAWHUB","generatedAt":"2026-10-11T14:16:20.321Z"}},"retryPolicy":{"maxAttempts":3,"backoffMs":[500,1500,3500],"retryableConditions":["HTTP_429","HTTP_503","NETWORK_TIMEOUT"]}},"endpoints":{"dossierUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/dossier","snapshotUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/snapshot","contractUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/contract","trustUrl":"https://www.xpersona.co/api/v1/agents/clawhub-yescan-ai-alibaba-quark-ocr/trust"}},"reliability":{"evidence":{"source":"runtime-metrics","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No trust, reliability, or runtime telemetry is available."},"trust":{"status":"unavailable","handshakeStatus":"UNKNOWN","verificationFreshnessHours":null,"reputationScore":null,"p95LatencyMs":null,"successRate30d":null,"fallbackRate":null,"attempts30d":null,"trustUpdatedAt":null,"trustConfidence":"unknown","sourceUpdatedAt":null,"freshnessSeconds":null},"decisionGuardrails":{"doNotUseIf":["Contract metadata is missing or unavailable for deterministic execution."],"safeUseWhen":[],"riskFlags":["missing_or_unavailable_contract","trust_data_unavailable","schema_references_missing"],"operationalConfidence":"low"},"executionMetrics":{"observedLatencyMsP50":null,"observedLatencyMsP95":null,"estimatedCostUsd":null,"uptime30d":null,"rateLimitRpm":null,"rateLimitBurst":null,"lastVerifiedAt":null,"verificationSource":null},"runtimeMetrics":{"successRate":null,"avgLatencyMs":null,"avgCostUsd":null,"hallucinationRate":null,"retryRate":null,"disputeRate":null,"p50Latency":null,"p95Latency":null,"lastUpdated":null}},"benchmarks":{"evidence":{"source":"no-benchmark-data","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No benchmark suites or observed failure patterns are available."},"suites":[],"failurePatterns":[]},"artifacts":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"high","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":null},"readme":"Skill: 夸克扫描王 - OCR文字识别 Alibaba-Quark-OCR\n\nOwner: yescan-ai\n\nSummary: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务\n\nTags: latest:1.0.12\n\nVersion history:\n\nv1.0.12 | 2026-07-10T08:17:55.148Z | user\n\n- 简化和调整了 description 描述文本，使用途更通用、提及自动触发条件，并补充了“不适用”场景说明。\n- 移除了不必要的元信息和文档文件：_meta.json、skill-card.md。\n- 更新了 CLI 配置示例命令中的 skill 名称字段（yescan-ocr-universal → alibaba-quark-ocr）。\n- 其余技能执行逻辑、场景匹配规则和接口规范未作变动。\n\nv1.0.0 | 2026-07-09T07:28:27.264Z | auto\n\nalibaba-quark-ocr 1.0.0\n\n- 首次发布，集成夸克扫描王高精准 OCR 文字识别能力。\n- 支持印刷、手写、表格、证件、票据、公式、商品图片等多种复杂场景。\n- 严格按照单一意图原则，自动匹配17类常见图片 OCR 场景。\n- 稳定支持图片 URL、本地文件、Base64 三种输入方式。\n- 明确数据隐私与外部 API 调用提示，环境变量配置简明易用。\n\nv1.0.11 | 2026-07-08T14:58:12.871Z | user\n\n- Skill renamed from \"yescan-ocr-universal\" to \"alibaba-quark-ocr\"\n- Description updated to further emphasize multi-language, print, handwriting and formula scenarios\n- No changes to functionality or procedural instructions\n- Initial metadata file (_meta.json) added\n\nv1.0.10 | 2026-07-08T14:48:16.487Z | user\n\n- Skill renamed from \"yescan-ocr-universal\" to \"alibaba-quark-ocr\"\n- Added metadata file (_meta.json); removed skill-card.md\n- SKILL.md now includes a more concise, improved description\n- No structural changes to usage, intent mapping, commands, or capabilities\n- Internal and external documentation updated for clarity and branding\n\nArchive index:\n\nArchive v1.0.12: 12 files, 19309 bytes\n\nFiles: scripts/common/__init__.py (1402b), scripts/common/constants.py (663b), scripts/common/file_saver.py (9484b), scripts/common/ocr_client.py (7188b), scripts/common/result_handlers.py (2943b), scripts/common/runner.py (3438b), scripts/common/scene_configs.py (3237b), scripts/common/validators.py (1943b), scripts/scan.py (254b), skill-card.md (2695b), SKILL.md (12945b), _meta.json (137b)\n\nFile v1.0.12:SKILL.md\n\n---\nname: alibaba-quark-ocr\ndescription: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务\nmetadata: {\"openclaw\":{\"emoji\":\"🔍︎\",\"requires\":{\"bins\":[\"python3\"],\"env\":[\"SCAN_WEBSERVICE_KEY\"]},\"primaryEnv\":\"SCAN_WEBSERVICE_KEY\"},\"homepage\":\"https://scan.quark.cn/business\"}\n---\n\n# 🧭 使用前必读（30 秒）\n\n> [!WARNING] **⚠️ 隐私与数据流向重要提示**\n> - **第三方服务交互**：本技能会将您提供的**图片 发送至夸克扫描王官方服务器 (`scan-business.quark.cn`)** 进行识别。\n> - **数据可见性**：夸克服务将获取并处理该图片内容，不会永久保存\n\n**推荐方式：CLI 配置（永久生效）**\n\n配置 `SCAN_WEBSERVICE_KEY` 环境变量到 OpenClaw：\n```bash\nopenclaw config set skills.entries.alibaba-quark-ocr.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\"\n```\n> ⚠️ 配置后需要**重启或开启新会话**才能生效（技能列表在 session 启动时加载）。\n\n**如何获取密钥？夸克扫描王官方入口在此**\n> 请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key。  \n> ⚠️ **注意**：若你点击链接后跳转到其他域名，说明该链接已失效 —— 请直接在浏览器地址栏手动输入 `https://scan.quark.cn/business`（这是当前唯一有效的官方入口）。\n\n---\n\n# Constraints\n- **单一意图原则：每次请求只执行一个意图类型，命中即执行**\n- **严禁自行构造任何命令参数，严禁伪造、拼接内部配置**\n- **严禁幻觉，禁止伪造请求和响应，不得沿用上一次的场景、参数进行假设**\n- **必须严格按照本指南指定的固定格式执行，不允许自行修改命令**\n\n#  技能执行指南(强制执行)\n\n第一步：**环境变量检查**\n- 若 `SCAN_WEBSERVICE_KEY` 未配置，立即返回：\n```json\n{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}\n```\n\n第二步：**输入处理**\n\n识别用户传入的图片类型，只能是以下三种之一：\n\n- 图片URL: url\n- 本地文件路径: path\n- 图片BASE64: base64\n\n未提供任何有效图片时，直接返回：\n```json\n{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}\n```\n\n第三步：**意图匹配&场景确定**\n- 按照下面列出的意图*从上到下顺序匹配。命中第一个即停止*\n- 命中后，*只确定当前意图对应的scene标识*\n\n第四步：**构建执行命令(固定格式，严禁修改)**：\n\n根据图片类型，严格使用下面对应格式：\n```bash\n# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\"\n```\n- 把`${IMAGE_URL}`/`${IMAGE_FILE_PATH}`/`${IMAGE_BASE64}`替换为真实值\n- 把`${SCENE_VALUE}`替换为当前意图对应的scene值\n- 直接执行命令，不增删任何参数，不修改JSON，不加引号，不换行\n\n第五步：**结果透出**：\n- 执行完成后，*原样返回执行结果*，不修改，不翻译，不美化，不总结\n- 成功 失败均直接透出，不重试\n\n\n## 场景与意图列表(按匹配优先级排序)\n\n1. 手写文档识别\n- 触发意图：当用户存在识别各类中英文手写内容（如学生作答、作文、会议记录、手写账单等）、将潦草或非标准手写图片转化为高精度可编辑文本，或突破传统 OCR 限制处理复杂手写场景的意图。\n- 场景scene标识：handwritten-ocr\n- 参考示例指令：\n  - \"帮我把这张手写笔记转成文字\"\n  - \"识别这张作文图片里的内容\"\n2. 表格识别\n- 触发意图：当用户存在识别图片中的各类表格（如 Excel/Word 表格、票据单据、手写表格、检查报告单等）、高精度提取文字内容并精准还原原始表格格式与结构的意图。\n- 场景scene标识：table-ocr\n- 参考示例指令：\n  - \"提取这张表格里的数据\"\n  - \"把这张报销单的表格转成 Excel 格式\"\n3. 身份证识别\n- 触发意图：当用户存在识别身份证图片、提取证件关键信息（包括但不限于姓名、身份证号、地址等字段）、将证件影像转化为结构化数据，或应用于身份核验、实名认证及信息准确性校验等场景的意图。\n- 场景scene标识：idcard-ocr\n- 参考示例指令：\n  - \"帮我读一下这张身份证\"\n  - \"提取身份证上的姓名和号码\"\n4. 社保卡识别\n- 触发意图：当用户存在识别社保卡图片、提取证件关键信息（包括但不限于姓名、社会保障号码、卡号、银联号码、性别、民族、发卡日期及有效期限等字段）、将证件影像转化为结构化数据，或应用于社保业务办理、身份核验及政务服务自动化等场景的意图。\n- 场景scene标识：social-security-card-ocr\n- 参考示例指令：\n  - \"识别这张社保卡的信息\"\n  - \"提取社保卡上的姓名和社保号\"\n5. 港澳通行证识别\n- 触发意图：当用户存在识别港澳通行证（或港澳台通行证）图片、提取证件关键信息（包括但不限于姓名、证件号码、签发机关、有效期限等 11 个字段）、将证件影像转化为结构化数据，或应用于身份核验、出入境管理及政务服务自动化等场景的意图。\n- 场景scene标识：travel-permit-ocr\n- 参考示例指令：\n  - \"读一下这张港澳通行证\"\n  - \"提取通行证上的姓名和证件号\"\n6. 学位证识别\n- 触发意图：当用户存在识别学位证书图片、提取证书关键信息（包括但不限于证书名称、学校、姓名、性别、出生日期、学习日期、学制、学历、学位、专业、证书编号及发证日期等 12 个字段）、将证书影像转化为结构化数据，或应用于企业人才信息录入和学历核验等场景的意图。\n- 场景scene标识：degree-certificate-ocr\n- 参考示例指令：\n  - \"识别这张学位证的内容\"\n  - \"提取学位证上的学校和专业\"\n7. 增值税发票识别\n- 触发意图：当用户存在识别增值税发票图片、提取单据关键信息（包括但不限于销售方、购买方、货物详情、金额等 30 多个字段）、将发票影像转化为结构化数据，或应用于财务报销自动化、税务管理及企业风控等场景的意图。\n- 场景scene标识：vat-invoice-ocr\n- 参考示例指令：\n  - \"提取这张增值税发票的信息\"\n  - \"识别发票上的金额和开票日期\"\n8. 火车票识别\n- 触发意图：当用户存在识别火车票图片、提取票号/出发站/到达站/车次/开车时间/票价/座位号/座位类型/旅客身份号码/旅客姓名等 10 个关键字段信息、将车票照片转化为结构化文本数据，或应用于企业出行报销场景的意图。\n- 场景scene标识：train-ticket-ocr\n- 参考示例指令：\n  - \"读一下这张火车票\"\n  - \"提取火车票的出发站和车次\"\n9. 公式识别\n- 触发意图：当用户存在识别数学/化学公式图片、高精度解析分数、矩阵、分段函数及化学方程式等复杂结构、将图像公式转化为可编辑的 LaTeX 代码或结构化数据，或应用于智能试卷自动批改、学术论文数字化归档、在线教育题目解析及科研文献深度分析等场景的意图。\n- 场景scene标识：formula-ocr\n- 参考示例指令：\n  - \"把这张公式图片转成 LaTeX\"\n  - \"识别这个数学公式的结构\"\n10. 题目识别\n- 触发意图：当用户上传包含习题/考题的图片，需**仅提取题目文本**（不含解答、批注或无关内容），并保留题号、题干结构，用于教育题库构建或题目检索。\n- 场景scene标识：question-ocr\n- 参考示例指令：\n  - \"提取这道题的关键信息\"\n  - \"识别题目中的问题部分\"\n11. 驾驶证识别\n- 触发意图：当用户存在识别驾驶证图片、提取证件关键信息（如证号、姓名、住址、有效期等）、将非结构化图像转化为结构化数据，或应用于身份核验、交通管理等场景的意图。\n- 场景scene标识：driver-license-ocr\n- 参考示例指令：\n  - \"读一下这张驾驶证\"\n  - \"提取驾驶证上的姓名和有效期\"\n12. 行驶证识别\n- 触发意图：当用户存在识别行驶证图片、提取证件关键信息（包括但不限于证号、姓名、住址、有效期、准驾车型等）、将行驶证影像转化为结构化数据，或应用于身份核验、交通管理及汽车租赁等场景的意图。\n- 场景scene标识：vehicle-license-ocr\n- 参考示例指令：\n  - \"识别这张行驶证\"\n  - \"提取行驶证上的车牌号和所有人\"\n13. 英文发票识别\n- 触发意图：当用户存在识别英文商业发票图片、提取单据关键信息（包括但不限于发票号、日期、买卖双方信息、商品明细、金额及税额等）、将非结构化英文单据转化为结构化数据，或应用于跨境贸易单证处理、海外费用报销及国际化财务自动化审核等场景的意图。\n- 场景scene标识：commercial-invoice-ocr\n- 参考示例指令：\n  - \"提取这张英文发票的信息\"\n  - \"识别发票上的总金额和日期\"\n14. 医疗报告单识别\n- 触发意图：当用户存在识别医疗报告单图片、提取报告关键信息（包括但不限于检验项目、结果、参考值等）、将医疗报告影像转化为结构化数据，或应用于电子病历归档、健康数据分析及远程医疗辅助诊断等场景的意图。\n- 场景scene标识：medical-report-ocr\n- 参考示例指令：\n  - \"读一下这张化验单\"\n  - \"提取报告中的异常指标\"\n15. 营业执照识别\n- 触发意图：当用户存在识别营业执照图片、提取证件关键信息（包括但不限于统一社会信用代码、名称、类型、法定代表人、经营范围等）、将执照影像转化为结构化数据，或应用于企业身份核验、工商注册自动化、供应链准入审核及金融风控等场景的意图。\n- 场景scene标识：business-license-ocr\n- 参考示例指令：\n  - \"识别这张营业执照\"\n  - \"提取公司名称和法人代表\"\n16. 商品图片识别\n- 触发意图：当用户需要识别图片中的具体商品对象，包括商品名称、品牌、品类等信息，用于商品检索或分类。\n- 场景scene标识：product-image-ocr\n- 参考示例指令：\n  - \"这是什么商品？\"\n  - \"识别这张图片里的产品品牌\"\n17. 通用文字提取（兜底意图）\n- 触发意图：当用户指令中不包含上述任何具体场景，仅表达提取纯文字意图时。\n- 场景scene标识：general-ocr\n- 参考示例指令：\n  - \"把这张图转成文字\"\n  - \"提取图中所有文字\"\n\n## ⛔ 不适用场景（When Not to Use）\n\n> 本技能**不支持**以下场景，请勿尝试：\n\n| 不支持的场景 | 原因 | 建议替代方案 |\n|------------|------|------------|\n| **视频处理** | 仅支持单张静态图片 | 先提取视频帧，再逐帧处理 |\n| **批量处理** | 每次调用仅限单张图片 | 如需批量，请循环调用或联系管理员 |\n| **实时摄像头流** | 非实时流处理架构 | 使用专用视频处理服务 |\n| **超大图片（>5MB）** | API 限制 | 先压缩或裁剪后再处理 |\n| **非图片格式** | 仅支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp | 先转换为支持的图片格式 |\n\n---\n\n## ⚠️ 重要注意事项\n\n1. **禁止修改固定格式**,只能替换场景标识和图片占位符\n2. **严禁自行构造 --scene 参数值，必须使用本文档指定的场景名**\n3. **图片大小限制：本地文件不超过5MB，支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp/webp 格式**\n\n---\n\n## 🔗 相关资源\n- [夸克扫描王开放平台](https://scan.quark.cn/business)\n\n## 📁 文件结构\n- `SKILL.md` —  本文档（意图分析 + 通用规范）\n- `scripts/scan.py` —  主执行脚本 (Python 3.9+)\n- `scripts/common/*.py` —  基础类库\n\nFile v1.0.12:_meta.json\n\n{\n  \"ownerId\": \"kn7765a4naksvzk0fmvenc4gjd88gjtb\",\n  \"slug\": \"alibaba-quark-ocr\",\n  \"version\": \"1.0.12\",\n  \"publishedAt\": 1783671475148\n}\n\nFile v1.0.12:skill-card.md\n\n## Description:\n\nThis skill uses Quark Scan King's OCR service to extract text and structured fields from user-provided images, including screenshots, scanned documents, handwriting, tables, equations, IDs, invoices, medical reports, business licenses, and product images.\n\nThis skill is ready for commercial/non-commercial use.\n\n## Publisher:\n\n[yescan-ai](https://clawhub.ai/user/yescan-ai)\n\n### License/Terms of Use:\n\nMIT-0\n\n## Use Case:\n\nDevelopers and external users use this skill when an agent needs to turn a single static image, image URL, or base64 image into OCR text or document-specific structured data. It is intended for OCR and document information extraction, not image generation, video processing, live camera streams, or batch processing.\n\n### Deployment Geography for Use:\n\nGlobal\n\n## Known Risks and Mitigations:\n\nRisk: Submitted images, including sensitive documents, are sent to Quark's OCR service using the configured API key.\n\nMitigation: Use this skill only when the user has approved the upload path; avoid or redact sensitive IDs, medical records, invoices, and other private documents unless the deployment is authorized for that data.\n\nRisk: The security summary flags under-disclosed image-editing scenes and weak controls around third-party uploads and credentials.\n\nMitigation: Restrict permitted scene values to the documented OCR use cases unless an operator explicitly approves broader image-editing or document-conversion behavior.\n\nRisk: The skill requires SCAN_WEBSERVICE_KEY for access to the third-party OCR service.\n\nMitigation: Provide the key through a managed environment secret, avoid exposing it in prompts or logs, and rotate it if it may have been shared.\n\n## Reference(s):\n\n- [ClawHub Skill Page](https://clawhub.ai/yescan-ai/skills/alibaba-quark-ocr)\n- [ClawHub Publisher Profile](https://clawhub.ai/user/yescan-ai)\n- [Quark Scan King Business Platform](https://scan.quark.cn/business)\n\n## Skill Output:\n\n**Output Type(s):** [text, markdown, code, shell commands, configuration, guidance]\n\n**Output Format:** [JSON returned by the OCR script, usually containing recognized text or structured fields in the data payload.]\n\n**Output Parameters:** [1D]\n\n**Other Properties Related to Output:** [Requires python3 and SCAN_WEBSERVICE_KEY; accepts exactly one image input as a URL, local file path, or base64 string.]\n\n## Skill Version(s):\n\n1.0.12 (source: server release evidence)\n\n## Ethical Considerations:\n\nUsers should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment.\n\nArchive v1.0.0: 12 files, 19155 bytes\n\nFiles: scripts/common/__init__.py (1402b), scripts/common/constants.py (663b), scripts/common/file_saver.py (9484b), scripts/common/ocr_client.py (7188b), scripts/common/result_handlers.py (2943b), scripts/common/runner.py (3438b), scripts/common/scene_configs.py (3237b), scripts/common/validators.py (1943b), scripts/scan.py (254b), skill-card.md (2278b), SKILL.md (12740b), _meta.json (136b)\n\nFile v1.0.0:SKILL.md\n\n---\nname: alibaba-quark-ocr\ndescription: 由夸克扫描王提供的高准取率 OCR 文字识别工具，支持印刷、手写、表格、多语言、公式等各种场景。支持图片、截图、扫描件中的文字提取，包括手写文档、表格内容、数学公式、商品图片等复杂场景。精准识别各类证件（身份证、社保卡、驾驶证、行驶证、港澳通行证、学位证等证件）及票据（增值税发票、火车票、英文发票等票据），同时支持医疗报告单、营业执照、习题题目等专业文档识别。\nmetadata: {\"openclaw\":{\"emoji\":\"🔍︎\",\"requires\":{\"bins\":[\"python3\"],\"env\":[\"SCAN_WEBSERVICE_KEY\"]},\"primaryEnv\":\"SCAN_WEBSERVICE_KEY\"},\"homepage\":\"https://scan.quark.cn/business\"}\n---\n\n# 🧭 使用前必读（30 秒）\n\n> [!WARNING] **⚠️ 隐私与数据流向重要提示**\n> - **第三方服务交互**：本技能会将您提供的**图片 发送至夸克扫描王官方服务器 (`scan-business.quark.cn`)** 进行识别。\n> - **数据可见性**：夸克服务将获取并处理该图片内容，不会永久保存\n\n**推荐方式：CLI 配置（永久生效）**\n\n配置 `SCAN_WEBSERVICE_KEY` 环境变量到 OpenClaw：\n```bash\nopenclaw config set skills.entries.yescan-ocr-universal.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\"\n```\n> ⚠️ 配置后需要**重启或开启新会话**才能生效（技能列表在 session 启动时加载）。\n\n**如何获取密钥？夸克扫描王官方入口在此**\n> 请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key。  \n> ⚠️ **注意**：若你点击链接后跳转到其他域名，说明该链接已失效 —— 请直接在浏览器地址栏手动输入 `https://scan.quark.cn/business`（这是当前唯一有效的官方入口）。\n\n---\n\n# Constraints\n- **单一意图原则：每次请求只执行一个意图类型，命中即执行**\n- **严禁自行构造任何命令参数，严禁伪造、拼接内部配置**\n- **严禁幻觉，禁止伪造请求和响应，不得沿用上一次的场景、参数进行假设**\n- **必须严格按照本指南指定的固定格式执行，不允许自行修改命令**\n\n#  技能执行指南(强制执行)\n\n第一步：**环境变量检查**\n- 若 `SCAN_WEBSERVICE_KEY` 未配置，立即返回：\n```json\n{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}\n```\n\n第二步：**输入处理**\n\n识别用户传入的图片类型，只能是以下三种之一：\n\n- 图片URL: url\n- 本地文件路径: path\n- 图片BASE64: base64\n\n未提供任何有效图片时，直接返回：\n```json\n{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}\n```\n\n第三步：**意图匹配&场景确定**\n- 按照下面列出的意图*从上到下顺序匹配。命中第一个即停止*\n- 命中后，*只确定当前意图对应的scene标识*\n\n第四步：**构建执行命令(固定格式，严禁修改)**：\n\n根据图片类型，严格使用下面对应格式：\n```bash\n# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\"\n```\n- 把`${IMAGE_URL}`/`${IMAGE_FILE_PATH}`/`${IMAGE_BASE64}`替换为真实值\n- 把`${SCENE_VALUE}`替换为当前意图对应的scene值\n- 直接执行命令，不增删任何参数，不修改JSON，不加引号，不换行\n\n第五步：**结果透出**：\n- 执行完成后，*原样返回执行结果*，不修改，不翻译，不美化，不总结\n- 成功 失败均直接透出，不重试\n\n\n## 场景与意图列表(按匹配优先级排序)\n\n1. 手写文档识别\n- 触发意图：当用户存在识别各类中英文手写内容（如学生作答、作文、会议记录、手写账单等）、将潦草或非标准手写图片转化为高精度可编辑文本，或突破传统 OCR 限制处理复杂手写场景的意图。\n- 场景scene标识：handwritten-ocr\n- 参考示例指令：\n  - \"帮我把这张手写笔记转成文字\"\n  - \"识别这张作文图片里的内容\"\n2. 表格识别\n- 触发意图：当用户存在识别图片中的各类表格（如 Excel/Word 表格、票据单据、手写表格、检查报告单等）、高精度提取文字内容并精准还原原始表格格式与结构的意图。\n- 场景scene标识：table-ocr\n- 参考示例指令：\n  - \"提取这张表格里的数据\"\n  - \"把这张报销单的表格转成 Excel 格式\"\n3. 身份证识别\n- 触发意图：当用户存在识别身份证图片、提取证件关键信息（包括但不限于姓名、身份证号、地址等字段）、将证件影像转化为结构化数据，或应用于身份核验、实名认证及信息准确性校验等场景的意图。\n- 场景scene标识：idcard-ocr\n- 参考示例指令：\n  - \"帮我读一下这张身份证\"\n  - \"提取身份证上的姓名和号码\"\n4. 社保卡识别\n- 触发意图：当用户存在识别社保卡图片、提取证件关键信息（包括但不限于姓名、社会保障号码、卡号、银联号码、性别、民族、发卡日期及有效期限等字段）、将证件影像转化为结构化数据，或应用于社保业务办理、身份核验及政务服务自动化等场景的意图。\n- 场景scene标识：social-security-card-ocr\n- 参考示例指令：\n  - \"识别这张社保卡的信息\"\n  - \"提取社保卡上的姓名和社保号\"\n5. 港澳通行证识别\n- 触发意图：当用户存在识别港澳通行证（或港澳台通行证）图片、提取证件关键信息（包括但不限于姓名、证件号码、签发机关、有效期限等 11 个字段）、将证件影像转化为结构化数据，或应用于身份核验、出入境管理及政务服务自动化等场景的意图。\n- 场景scene标识：travel-permit-ocr\n- 参考示例指令：\n  - \"读一下这张港澳通行证\"\n  - \"提取通行证上的姓名和证件号\"\n6. 学位证识别\n- 触发意图：当用户存在识别学位证书图片、提取证书关键信息（包括但不限于证书名称、学校、姓名、性别、出生日期、学习日期、学制、学历、学位、专业、证书编号及发证日期等 12 个字段）、将证书影像转化为结构化数据，或应用于企业人才信息录入和学历核验等场景的意图。\n- 场景scene标识：degree-certificate-ocr\n- 参考示例指令：\n  - \"识别这张学位证的内容\"\n  - \"提取学位证上的学校和专业\"\n7. 增值税发票识别\n- 触发意图：当用户存在识别增值税发票图片、提取单据关键信息（包括但不限于销售方、购买方、货物详情、金额等 30 多个字段）、将发票影像转化为结构化数据，或应用于财务报销自动化、税务管理及企业风控等场景的意图。\n- 场景scene标识：vat-invoice-ocr\n- 参考示例指令：\n  - \"提取这张增值税发票的信息\"\n  - \"识别发票上的金额和开票日期\"\n8. 火车票识别\n- 触发意图：当用户存在识别火车票图片、提取票号/出发站/到达站/车次/开车时间/票价/座位号/座位类型/旅客身份号码/旅客姓名等 10 个关键字段信息、将车票照片转化为结构化文本数据，或应用于企业出行报销场景的意图。\n- 场景scene标识：train-ticket-ocr\n- 参考示例指令：\n  - \"读一下这张火车票\"\n  - \"提取火车票的出发站和车次\"\n9. 公式识别\n- 触发意图：当用户存在识别数学/化学公式图片、高精度解析分数、矩阵、分段函数及化学方程式等复杂结构、将图像公式转化为可编辑的 LaTeX 代码或结构化数据，或应用于智能试卷自动批改、学术论文数字化归档、在线教育题目解析及科研文献深度分析等场景的意图。\n- 场景scene标识：formula-ocr\n- 参考示例指令：\n  - \"把这张公式图片转成 LaTeX\"\n  - \"识别这个数学公式的结构\"\n10. 题目识别\n- 触发意图：当用户上传包含习题/考题的图片，需**仅提取题目文本**（不含解答、批注或无关内容），并保留题号、题干结构，用于教育题库构建或题目检索。\n- 场景scene标识：question-ocr\n- 参考示例指令：\n  - \"提取这道题的关键信息\"\n  - \"识别题目中的问题部分\"\n11. 驾驶证识别\n- 触发意图：当用户存在识别驾驶证图片、提取证件关键信息（如证号、姓名、住址、有效期等）、将非结构化图像转化为结构化数据，或应用于身份核验、交通管理等场景的意图。\n- 场景scene标识：driver-license-ocr\n- 参考示例指令：\n  - \"读一下这张驾驶证\"\n  - \"提取驾驶证上的姓名和有效期\"\n12. 行驶证识别\n- 触发意图：当用户存在识别行驶证图片、提取证件关键信息（包括但不限于证号、姓名、住址、有效期、准驾车型等）、将行驶证影像转化为结构化数据，或应用于身份核验、交通管理及汽车租赁等场景的意图。\n- 场景scene标识：vehicle-license-ocr\n- 参考示例指令：\n  - \"识别这张行驶证\"\n  - \"提取行驶证上的车牌号和所有人\"\n13. 英文发票识别\n- 触发意图：当用户存在识别英文商业发票图片、提取单据关键信息（包括但不限于发票号、日期、买卖双方信息、商品明细、金额及税额等）、将非结构化英文单据转化为结构化数据，或应用于跨境贸易单证处理、海外费用报销及国际化财务自动化审核等场景的意图。\n- 场景scene标识：commercial-invoice-ocr\n- 参考示例指令：\n  - \"提取这张英文发票的信息\"\n  - \"识别发票上的总金额和日期\"\n14. 医疗报告单识别\n- 触发意图：当用户存在识别医疗报告单图片、提取报告关键信息（包括但不限于检验项目、结果、参考值等）、将医疗报告影像转化为结构化数据，或应用于电子病历归档、健康数据分析及远程医疗辅助诊断等场景的意图。\n- 场景scene标识：medical-report-ocr\n- 参考示例指令：\n  - \"读一下这张化验单\"\n  - \"提取报告中的异常指标\"\n15. 营业执照识别\n- 触发意图：当用户存在识别营业执照图片、提取证件关键信息（包括但不限于统一社会信用代码、名称、类型、法定代表人、经营范围等）、将执照影像转化为结构化数据，或应用于企业身份核验、工商注册自动化、供应链准入审核及金融风控等场景的意图。\n- 场景scene标识：business-license-ocr\n- 参考示例指令：\n  - \"识别这张营业执照\"\n  - \"提取公司名称和法人代表\"\n16. 商品图片识别\n- 触发意图：当用户需要识别图片中的具体商品对象，包括商品名称、品牌、品类等信息，用于商品检索或分类。\n- 场景scene标识：product-image-ocr\n- 参考示例指令：\n  - \"这是什么商品？\"\n  - \"识别这张图片里的产品品牌\"\n17. 通用文字提取（兜底意图）\n- 触发意图：当用户指令中不包含上述任何具体场景，仅表达提取纯文字意图时。\n- 场景scene标识：general-ocr\n- 参考示例指令：\n  - \"把这张图转成文字\"\n  - \"提取图中所有文字\"\n\n## ⛔ 不适用场景（When Not to Use）\n\n> 本技能**不支持**以下场景，请勿尝试：\n\n| 不支持的场景 | 原因 | 建议替代方案 |\n|------------|------|------------|\n| **视频处理** | 仅支持单张静态图片 | 先提取视频帧，再逐帧处理 |\n| **批量处理** | 每次调用仅限单张图片 | 如需批量，请循环调用或联系管理员 |\n| **实时摄像头流** | 非实时流处理架构 | 使用专用视频处理服务 |\n| **超大图片（>5MB）** | API 限制 | 先压缩或裁剪后再处理 |\n| **非图片格式** | 仅支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp | 先转换为支持的图片格式 |\n\n---\n\n## ⚠️ 重要注意事项\n\n1. **禁止修改固定格式**,只能替换场景标识和图片占位符\n2. **严禁自行构造 --scene 参数值，必须使用本文档指定的场景名**\n3. **图片大小限制：本地文件不超过5MB，支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp/webp 格式**\n\n---\n\n## 🔗 相关资源\n- [夸克扫描王开放平台](https://scan.quark.cn/business)\n\n## 📁 文件结构\n- `SKILL.md` —  本文档（意图分析 + 通用规范）\n- `scripts/scan.py` —  主执行脚本 (Python 3.9+)\n- `scripts/common/*.py` —  基础类库\n\nFile v1.0.0:_meta.json\n\n{\n  \"ownerId\": \"kn7765a4naksvzk0fmvenc4gjd88gjtb\",\n  \"slug\": \"alibaba-quark-ocr\",\n  \"version\": \"1.0.0\",\n  \"publishedAt\": 1783582107264\n}\n\nFile v1.0.0:skill-card.md\n\n## Description: <br>\n由夸克扫描王提供的 OCR 文字识别技能，支持从图片、截图和扫描件中提取印刷体、手写内容、表格、公式、证件、票据、医疗报告、营业执照、商品图片和通用文本。 <br>\n\nThis skill is ready for commercial/non-commercial use. <br>\n\n## Publisher: <br>\n[yescan-ai](https://clawhub.ai/user/yescan-ai) <br>\n\n### License/Terms of Use: <br>\nMIT-0 <br>\n\n\n## Use Case: <br>\nExternal users and developers use this skill to route a single image OCR request to the appropriate Quark OCR scene and return the service result. It is suited for extracting text or structured data from supported document, receipt, certificate, table, formula, question, product, and general image inputs. <br>\n\n### Deployment Geography for Use: <br>\nGlobal <br>\n\n## Known Risks and Mitigations: <br>\nRisk: Submitted images and documents are sent to Quark's external OCR service and may contain sensitive identity, finance, medical, or business information. <br>\nMitigation: Use a dedicated SCAN_WEBSERVICE_KEY and submit only images you are allowed to share with that provider. <br>\nRisk: The skill is scoped to OCR for supported static image formats and may be unsuitable for unsupported media or oversized files. <br>\nMitigation: Use supported image inputs, keep local files within the documented 5 MB limit, and convert or split unsupported content before use. <br>\n\n\n## Reference(s): <br>\n- [ClawHub skill page](https://clawhub.ai/yescan-ai/skills/alibaba-quark-ocr) <br>\n- [Quark Scan business platform](https://scan.quark.cn/business) <br>\n\n\n## Skill Output: <br>\n**Output Type(s):** [text, JSON, shell commands, guidance] <br>\n**Output Format:** [JSON service responses and concise command guidance] <br>\n**Output Parameters:** [1D] <br>\n**Other Properties Related to Output:** [Requires python3 and SCAN_WEBSERVICE_KEY; each request handles one image and one OCR scene.] <br>\n\n## Skill Version(s): <br>\n1.0.0 (source: server release metadata) <br>\n\n## Ethical Considerations: <br>\nUsers should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment. <br>\n\nArchive v1.0.11: 12 files, 18971 bytes\n\nFiles: _meta.json (137b), scripts/common/__init__.py (1402b), scripts/common/constants.py (663b), scripts/common/file_saver.py (9484b), scripts/common/ocr_client.py (7188b), scripts/common/result_handlers.py (2943b), scripts/common/runner.py (3438b), scripts/common/scene_configs.py (3237b), scripts/common/validators.py (1943b), scripts/scan.py (254b), skill-card.md (2178b), SKILL.md (12740b)\n\nFile v1.0.11:SKILL.md\n\n---\nname: alibaba-quark-ocr\ndescription: 由夸克扫描王提供的高准取率 OCR 文字识别工具，支持印刷、手写、表格、多语言、公式等各种场景。支持图片、截图、扫描件中的文字提取，包括手写文档、表格内容、数学公式、商品图片等复杂场景。精准识别各类证件（身份证、社保卡、驾驶证、行驶证、港澳通行证、学位证等证件）及票据（增值税发票、火车票、英文发票等票据），同时支持医疗报告单、营业执照、习题题目等专业文档识别。\nmetadata: {\"openclaw\":{\"emoji\":\"🔍︎\",\"requires\":{\"bins\":[\"python3\"],\"env\":[\"SCAN_WEBSERVICE_KEY\"]},\"primaryEnv\":\"SCAN_WEBSERVICE_KEY\"},\"homepage\":\"https://scan.quark.cn/business\"}\n---\n\n# 🧭 使用前必读（30 秒）\n\n> [!WARNING] **⚠️ 隐私与数据流向重要提示**\n> - **第三方服务交互**：本技能会将您提供的**图片 发送至夸克扫描王官方服务器 (`scan-business.quark.cn`)** 进行识别。\n> - **数据可见性**：夸克服务将获取并处理该图片内容，不会永久保存\n\n**推荐方式：CLI 配置（永久生效）**\n\n配置 `SCAN_WEBSERVICE_KEY` 环境变量到 OpenClaw：\n```bash\nopenclaw config set skills.entries.yescan-ocr-universal.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\"\n```\n> ⚠️ 配置后需要**重启或开启新会话**才能生效（技能列表在 session 启动时加载）。\n\n**如何获取密钥？夸克扫描王官方入口在此**\n> 请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key。  \n> ⚠️ **注意**：若你点击链接后跳转到其他域名，说明该链接已失效 —— 请直接在浏览器地址栏手动输入 `https://scan.quark.cn/business`（这是当前唯一有效的官方入口）。\n\n---\n\n# Constraints\n- **单一意图原则：每次请求只执行一个意图类型，命中即执行**\n- **严禁自行构造任何命令参数，严禁伪造、拼接内部配置**\n- **严禁幻觉，禁止伪造请求和响应，不得沿用上一次的场景、参数进行假设**\n- **必须严格按照本指南指定的固定格式执行，不允许自行修改命令**\n\n#  技能执行指南(强制执行)\n\n第一步：**环境变量检查**\n- 若 `SCAN_WEBSERVICE_KEY` 未配置，立即返回：\n```json\n{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}\n```\n\n第二步：**输入处理**\n\n识别用户传入的图片类型，只能是以下三种之一：\n\n- 图片URL: url\n- 本地文件路径: path\n- 图片BASE64: base64\n\n未提供任何有效图片时，直接返回：\n```json\n{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}\n```\n\n第三步：**意图匹配&场景确定**\n- 按照下面列出的意图*从上到下顺序匹配。命中第一个即停止*\n- 命中后，*只确定当前意图对应的scene标识*\n\n第四步：**构建执行命令(固定格式，严禁修改)**：\n\n根据图片类型，严格使用下面对应格式：\n```bash\n# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\"\n```\n- 把`${IMAGE_URL}`/`${IMAGE_FILE_PATH}`/`${IMAGE_BASE64}`替换为真实值\n- 把`${SCENE_VALUE}`替换为当前意图对应的scene值\n- 直接执行命令，不增删任何参数，不修改JSON，不加引号，不换行\n\n第五步：**结果透出**：\n- 执行完成后，*原样返回执行结果*，不修改，不翻译，不美化，不总结\n- 成功 失败均直接透出，不重试\n\n\n## 场景与意图列表(按匹配优先级排序)\n\n1. 手写文档识别\n- 触发意图：当用户存在识别各类中英文手写内容（如学生作答、作文、会议记录、手写账单等）、将潦草或非标准手写图片转化为高精度可编辑文本，或突破传统 OCR 限制处理复杂手写场景的意图。\n- 场景scene标识：handwritten-ocr\n- 参考示例指令：\n  - \"帮我把这张手写笔记转成文字\"\n  - \"识别这张作文图片里的内容\"\n2. 表格识别\n- 触发意图：当用户存在识别图片中的各类表格（如 Excel/Word 表格、票据单据、手写表格、检查报告单等）、高精度提取文字内容并精准还原原始表格格式与结构的意图。\n- 场景scene标识：table-ocr\n- 参考示例指令：\n  - \"提取这张表格里的数据\"\n  - \"把这张报销单的表格转成 Excel 格式\"\n3. 身份证识别\n- 触发意图：当用户存在识别身份证图片、提取证件关键信息（包括但不限于姓名、身份证号、地址等字段）、将证件影像转化为结构化数据，或应用于身份核验、实名认证及信息准确性校验等场景的意图。\n- 场景scene标识：idcard-ocr\n- 参考示例指令：\n  - \"帮我读一下这张身份证\"\n  - \"提取身份证上的姓名和号码\"\n4. 社保卡识别\n- 触发意图：当用户存在识别社保卡图片、提取证件关键信息（包括但不限于姓名、社会保障号码、卡号、银联号码、性别、民族、发卡日期及有效期限等字段）、将证件影像转化为结构化数据，或应用于社保业务办理、身份核验及政务服务自动化等场景的意图。\n- 场景scene标识：social-security-card-ocr\n- 参考示例指令：\n  - \"识别这张社保卡的信息\"\n  - \"提取社保卡上的姓名和社保号\"\n5. 港澳通行证识别\n- 触发意图：当用户存在识别港澳通行证（或港澳台通行证）图片、提取证件关键信息（包括但不限于姓名、证件号码、签发机关、有效期限等 11 个字段）、将证件影像转化为结构化数据，或应用于身份核验、出入境管理及政务服务自动化等场景的意图。\n- 场景scene标识：travel-permit-ocr\n- 参考示例指令：\n  - \"读一下这张港澳通行证\"\n  - \"提取通行证上的姓名和证件号\"\n6. 学位证识别\n- 触发意图：当用户存在识别学位证书图片、提取证书关键信息（包括但不限于证书名称、学校、姓名、性别、出生日期、学习日期、学制、学历、学位、专业、证书编号及发证日期等 12 个字段）、将证书影像转化为结构化数据，或应用于企业人才信息录入和学历核验等场景的意图。\n- 场景scene标识：degree-certificate-ocr\n- 参考示例指令：\n  - \"识别这张学位证的内容\"\n  - \"提取学位证上的学校和专业\"\n7. 增值税发票识别\n- 触发意图：当用户存在识别增值税发票图片、提取单据关键信息（包括但不限于销售方、购买方、货物详情、金额等 30 多个字段）、将发票影像转化为结构化数据，或应用于财务报销自动化、税务管理及企业风控等场景的意图。\n- 场景scene标识：vat-invoice-ocr\n- 参考示例指令：\n  - \"提取这张增值税发票的信息\"\n  - \"识别发票上的金额和开票日期\"\n8. 火车票识别\n- 触发意图：当用户存在识别火车票图片、提取票号/出发站/到达站/车次/开车时间/票价/座位号/座位类型/旅客身份号码/旅客姓名等 10 个关键字段信息、将车票照片转化为结构化文本数据，或应用于企业出行报销场景的意图。\n- 场景scene标识：train-ticket-ocr\n- 参考示例指令：\n  - \"读一下这张火车票\"\n  - \"提取火车票的出发站和车次\"\n9. 公式识别\n- 触发意图：当用户存在识别数学/化学公式图片、高精度解析分数、矩阵、分段函数及化学方程式等复杂结构、将图像公式转化为可编辑的 LaTeX 代码或结构化数据，或应用于智能试卷自动批改、学术论文数字化归档、在线教育题目解析及科研文献深度分析等场景的意图。\n- 场景scene标识：formula-ocr\n- 参考示例指令：\n  - \"把这张公式图片转成 LaTeX\"\n  - \"识别这个数学公式的结构\"\n10. 题目识别\n- 触发意图：当用户上传包含习题/考题的图片，需**仅提取题目文本**（不含解答、批注或无关内容），并保留题号、题干结构，用于教育题库构建或题目检索。\n- 场景scene标识：question-ocr\n- 参考示例指令：\n  - \"提取这道题的关键信息\"\n  - \"识别题目中的问题部分\"\n11. 驾驶证识别\n- 触发意图：当用户存在识别驾驶证图片、提取证件关键信息（如证号、姓名、住址、有效期等）、将非结构化图像转化为结构化数据，或应用于身份核验、交通管理等场景的意图。\n- 场景scene标识：driver-license-ocr\n- 参考示例指令：\n  - \"读一下这张驾驶证\"\n  - \"提取驾驶证上的姓名和有效期\"\n12. 行驶证识别\n- 触发意图：当用户存在识别行驶证图片、提取证件关键信息（包括但不限于证号、姓名、住址、有效期、准驾车型等）、将行驶证影像转化为结构化数据，或应用于身份核验、交通管理及汽车租赁等场景的意图。\n- 场景scene标识：vehicle-license-ocr\n- 参考示例指令：\n  - \"识别这张行驶证\"\n  - \"提取行驶证上的车牌号和所有人\"\n13. 英文发票识别\n- 触发意图：当用户存在识别英文商业发票图片、提取单据关键信息（包括但不限于发票号、日期、买卖双方信息、商品明细、金额及税额等）、将非结构化英文单据转化为结构化数据，或应用于跨境贸易单证处理、海外费用报销及国际化财务自动化审核等场景的意图。\n- 场景scene标识：commercial-invoice-ocr\n- 参考示例指令：\n  - \"提取这张英文发票的信息\"\n  - \"识别发票上的总金额和日期\"\n14. 医疗报告单识别\n- 触发意图：当用户存在识别医疗报告单图片、提取报告关键信息（包括但不限于检验项目、结果、参考值等）、将医疗报告影像转化为结构化数据，或应用于电子病历归档、健康数据分析及远程医疗辅助诊断等场景的意图。\n- 场景scene标识：medical-report-ocr\n- 参考示例指令：\n  - \"读一下这张化验单\"\n  - \"提取报告中的异常指标\"\n15. 营业执照识别\n- 触发意图：当用户存在识别营业执照图片、提取证件关键信息（包括但不限于统一社会信用代码、名称、类型、法定代表人、经营范围等）、将执照影像转化为结构化数据，或应用于企业身份核验、工商注册自动化、供应链准入审核及金融风控等场景的意图。\n- 场景scene标识：business-license-ocr\n- 参考示例指令：\n  - \"识别这张营业执照\"\n  - \"提取公司名称和法人代表\"\n16. 商品图片识别\n- 触发意图：当用户需要识别图片中的具体商品对象，包括商品名称、品牌、品类等信息，用于商品检索或分类。\n- 场景scene标识：product-image-ocr\n- 参考示例指令：\n  - \"这是什么商品？\"\n  - \"识别这张图片里的产品品牌\"\n17. 通用文字提取（兜底意图）\n- 触发意图：当用户指令中不包含上述任何具体场景，仅表达提取纯文字意图时。\n- 场景scene标识：general-ocr\n- 参考示例指令：\n  - \"把这张图转成文字\"\n  - \"提取图中所有文字\"\n\n## ⛔ 不适用场景（When Not to Use）\n\n> 本技能**不支持**以下场景，请勿尝试：\n\n| 不支持的场景 | 原因 | 建议替代方案 |\n|------------|------|------------|\n| **视频处理** | 仅支持单张静态图片 | 先提取视频帧，再逐帧处理 |\n| **批量处理** | 每次调用仅限单张图片 | 如需批量，请循环调用或联系管理员 |\n| **实时摄像头流** | 非实时流处理架构 | 使用专用视频处理服务 |\n| **超大图片（>5MB）** | API 限制 | 先压缩或裁剪后再处理 |\n| **非图片格式** | 仅支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp | 先转换为支持的图片格式 |\n\n---\n\n## ⚠️ 重要注意事项\n\n1. **禁止修改固定格式**,只能替换场景标识和图片占位符\n2. **严禁自行构造 --scene 参数值，必须使用本文档指定的场景名**\n3. **图片大小限制：本地文件不超过5MB，支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp/webp 格式**\n\n---\n\n## 🔗 相关资源\n- [夸克扫描王开放平台](https://scan.quark.cn/business)\n\n## 📁 文件结构\n- `SKILL.md` —  本文档（意图分析 + 通用规范）\n- `scripts/scan.py` —  主执行脚本 (Python 3.9+)\n- `scripts/common/*.py` —  基础类库\n\nFile v1.0.11:_meta.json\n\n{\n  \"ownerId\": \"kn7765a4naksvzk0fmvenc4gjd88gjtb\",\n  \"slug\": \"alibaba-quark-ocr\",\n  \"version\": \"1.0.11\",\n  \"publishedAt\": 1783522692871\n}\n\nFile v1.0.11:skill-card.md\n\n## Description: <br>\nQuark Scanning OCR extracts text and structured data from images, screenshots, scans, identity documents, invoices, medical reports, forms, tables, handwriting, multilingual text, and formulas. <br>\n\nThis skill is ready for commercial/non-commercial use. <br>\n\n## Publisher: <br>\n[yescan-ai](https://clawhub.ai/user/yescan-ai) <br>\n\n### License/Terms of Use: <br>\nMIT-0 <br>\n\n\n## Use Case: <br>\nDevelopers and agent users use this skill to route a single image, screenshot, or scan to Quark OCR and return recognized text or structured fields for document, form, invoice, identity document, education, and formula workflows. <br>\n\n### Deployment Geography for Use: <br>\nGlobal <br>\n\n## Known Risks and Mitigations: <br>\nRisk: Submitted images may contain sensitive identity, invoice, business, or medical information and are sent to Quark's cloud OCR service. <br>\nMitigation: Use this skill only for documents approved for third-party cloud processing, and avoid documents whose privacy or compliance requirements prohibit that processing. <br>\nRisk: OCR requests depend on a SCAN_WEBSERVICE_KEY tied to the configured Quark service account. <br>\nMitigation: Verify the intended skill entry and API key before use, especially in shared or production agent environments. <br>\n\n\n## Reference(s): <br>\n- [Quark Scanning OCR business platform](https://scan.quark.cn/business) <br>\n\n\n## Skill Output: <br>\n**Output Type(s):** [Text, JSON, Shell commands, Configuration guidance] <br>\n**Output Format:** [Markdown guidance with bash commands; runtime output is JSON returned from the OCR service.] <br>\n**Output Parameters:** [1D] <br>\n**Other Properties Related to Output:** [Requires SCAN_WEBSERVICE_KEY and exactly one image input as a URL, local path, or base64 value; local images are limited to 5 MB.] <br>\n\n## Skill Version(s): <br>\n1.0.11 (source: server release evidence) <br>\n\n## Ethical Considerations: <br>\nUsers should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment. <br>\n\nArchive v1.0.10: 11 files, 17785 bytes\n\nFiles: _meta.json (137b), scripts/common/__init__.py (1402b), scripts/common/constants.py (663b), scripts/common/file_saver.py (9484b), scripts/common/ocr_client.py (7188b), scripts/common/result_handlers.py (2943b), scripts/common/runner.py (3438b), scripts/common/scene_configs.py (3237b), scripts/common/validators.py (1943b), scripts/scan.py (254b), SKILL.md (12782b)\n\nFile v1.0.10:SKILL.md\n\n---\nname: alibaba-quark-ocr\ndescription: 由夸克扫描王提供的专业 OCR 文字识别与处理工具。高准确率的OCR文字识别工具，支持印刷、手写、表格、多语言、公式等各种场景。支持图片、截图、扫描件中的文字提取，包括手写文档、表格内容、数学公式、商品图片等复杂场景。精准识别各类证件（身份证、社保卡、驾驶证、行驶证、港澳通行证、学位证等证件）及票据（增值税发票、火车票、英文发票等票据），同时支持医疗报告单、营业执照、习题题目等专业文档识别。\nmetadata: {\"openclaw\":{\"emoji\":\"🔍︎\",\"requires\":{\"bins\":[\"python3\"],\"env\":[\"SCAN_WEBSERVICE_KEY\"]},\"primaryEnv\":\"SCAN_WEBSERVICE_KEY\"},\"homepage\":\"https://scan.quark.cn/business\"}\n---\n\n# 🧭 使用前必读（30 秒）\n\n> [!WARNING] **⚠️ 隐私与数据流向重要提示**\n> - **第三方服务交互**：本技能会将您提供的**图片 发送至夸克扫描王官方服务器 (`scan-business.quark.cn`)** 进行识别。\n> - **数据可见性**：夸克服务将获取并处理该图片内容，不会永久保存\n\n**推荐方式：CLI 配置（永久生效）**\n\n配置 `SCAN_WEBSERVICE_KEY` 环境变量到 OpenClaw：\n```bash\nopenclaw config set skills.entries.yescan-ocr-universal.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\"\n```\n> ⚠️ 配置后需要**重启或开启新会话**才能生效（技能列表在 session 启动时加载）。\n\n**如何获取密钥？夸克扫描王官方入口在此**\n> 请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key。  \n> ⚠️ **注意**：若你点击链接后跳转到其他域名，说明该链接已失效 —— 请直接在浏览器地址栏手动输入 `https://scan.quark.cn/business`（这是当前唯一有效的官方入口）。\n\n---\n\n# Constraints\n- **单一意图原则：每次请求只执行一个意图类型，命中即执行**\n- **严禁自行构造任何命令参数，严禁伪造、拼接内部配置**\n- **严禁幻觉，禁止伪造请求和响应，不得沿用上一次的场景、参数进行假设**\n- **必须严格按照本指南指定的固定格式执行，不允许自行修改命令**\n\n#  技能执行指南(强制执行)\n\n第一步：**环境变量检查**\n- 若 `SCAN_WEBSERVICE_KEY` 未配置，立即返回：\n```json\n{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}\n```\n\n第二步：**输入处理**\n\n识别用户传入的图片类型，只能是以下三种之一：\n\n- 图片URL: url\n- 本地文件路径: path\n- 图片BASE64: base64\n\n未提供任何有效图片时，直接返回：\n```json\n{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}\n```\n\n第三步：**意图匹配&场景确定**\n- 按照下面列出的意图*从上到下顺序匹配。命中第一个即停止*\n- 命中后，*只确定当前意图对应的scene标识*\n\n第四步：**构建执行命令(固定格式，严禁修改)**：\n\n根据图片类型，严格使用下面对应格式：\n```bash\n# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\"\n```\n- 把`${IMAGE_URL}`/`${IMAGE_FILE_PATH}`/`${IMAGE_BASE64}`替换为真实值\n- 把`${SCENE_VALUE}`替换为当前意图对应的scene值\n- 直接执行命令，不增删任何参数，不修改JSON，不加引号，不换行\n\n第五步：**结果透出**：\n- 执行完成后，*原样返回执行结果*，不修改，不翻译，不美化，不总结\n- 成功 失败均直接透出，不重试\n\n\n## 场景与意图列表(按匹配优先级排序)\n\n1. 手写文档识别\n- 触发意图：当用户存在识别各类中英文手写内容（如学生作答、作文、会议记录、手写账单等）、将潦草或非标准手写图片转化为高精度可编辑文本，或突破传统 OCR 限制处理复杂手写场景的意图。\n- 场景scene标识：handwritten-ocr\n- 参考示例指令：\n  - \"帮我把这张手写笔记转成文字\"\n  - \"识别这张作文图片里的内容\"\n2. 表格识别\n- 触发意图：当用户存在识别图片中的各类表格（如 Excel/Word 表格、票据单据、手写表格、检查报告单等）、高精度提取文字内容并精准还原原始表格格式与结构的意图。\n- 场景scene标识：table-ocr\n- 参考示例指令：\n  - \"提取这张表格里的数据\"\n  - \"把这张报销单的表格转成 Excel 格式\"\n3. 身份证识别\n- 触发意图：当用户存在识别身份证图片、提取证件关键信息（包括但不限于姓名、身份证号、地址等字段）、将证件影像转化为结构化数据，或应用于身份核验、实名认证及信息准确性校验等场景的意图。\n- 场景scene标识：idcard-ocr\n- 参考示例指令：\n  - \"帮我读一下这张身份证\"\n  - \"提取身份证上的姓名和号码\"\n4. 社保卡识别\n- 触发意图：当用户存在识别社保卡图片、提取证件关键信息（包括但不限于姓名、社会保障号码、卡号、银联号码、性别、民族、发卡日期及有效期限等字段）、将证件影像转化为结构化数据，或应用于社保业务办理、身份核验及政务服务自动化等场景的意图。\n- 场景scene标识：social-security-card-ocr\n- 参考示例指令：\n  - \"识别这张社保卡的信息\"\n  - \"提取社保卡上的姓名和社保号\"\n5. 港澳通行证识别\n- 触发意图：当用户存在识别港澳通行证（或港澳台通行证）图片、提取证件关键信息（包括但不限于姓名、证件号码、签发机关、有效期限等 11 个字段）、将证件影像转化为结构化数据，或应用于身份核验、出入境管理及政务服务自动化等场景的意图。\n- 场景scene标识：travel-permit-ocr\n- 参考示例指令：\n  - \"读一下这张港澳通行证\"\n  - \"提取通行证上的姓名和证件号\"\n6. 学位证识别\n- 触发意图：当用户存在识别学位证书图片、提取证书关键信息（包括但不限于证书名称、学校、姓名、性别、出生日期、学习日期、学制、学历、学位、专业、证书编号及发证日期等 12 个字段）、将证书影像转化为结构化数据，或应用于企业人才信息录入和学历核验等场景的意图。\n- 场景scene标识：degree-certificate-ocr\n- 参考示例指令：\n  - \"识别这张学位证的内容\"\n  - \"提取学位证上的学校和专业\"\n7. 增值税发票识别\n- 触发意图：当用户存在识别增值税发票图片、提取单据关键信息（包括但不限于销售方、购买方、货物详情、金额等 30 多个字段）、将发票影像转化为结构化数据，或应用于财务报销自动化、税务管理及企业风控等场景的意图。\n- 场景scene标识：vat-invoice-ocr\n- 参考示例指令：\n  - \"提取这张增值税发票的信息\"\n  - \"识别发票上的金额和开票日期\"\n8. 火车票识别\n- 触发意图：当用户存在识别火车票图片、提取票号/出发站/到达站/车次/开车时间/票价/座位号/座位类型/旅客身份号码/旅客姓名等 10 个关键字段信息、将车票照片转化为结构化文本数据，或应用于企业出行报销场景的意图。\n- 场景scene标识：train-ticket-ocr\n- 参考示例指令：\n  - \"读一下这张火车票\"\n  - \"提取火车票的出发站和车次\"\n9. 公式识别\n- 触发意图：当用户存在识别数学/化学公式图片、高精度解析分数、矩阵、分段函数及化学方程式等复杂结构、将图像公式转化为可编辑的 LaTeX 代码或结构化数据，或应用于智能试卷自动批改、学术论文数字化归档、在线教育题目解析及科研文献深度分析等场景的意图。\n- 场景scene标识：formula-ocr\n- 参考示例指令：\n  - \"把这张公式图片转成 LaTeX\"\n  - \"识别这个数学公式的结构\"\n10. 题目识别\n- 触发意图：当用户上传包含习题/考题的图片，需**仅提取题目文本**（不含解答、批注或无关内容），并保留题号、题干结构，用于教育题库构建或题目检索。\n- 场景scene标识：question-ocr\n- 参考示例指令：\n  - \"提取这道题的关键信息\"\n  - \"识别题目中的问题部分\"\n11. 驾驶证识别\n- 触发意图：当用户存在识别驾驶证图片、提取证件关键信息（如证号、姓名、住址、有效期等）、将非结构化图像转化为结构化数据，或应用于身份核验、交通管理等场景的意图。\n- 场景scene标识：driver-license-ocr\n- 参考示例指令：\n  - \"读一下这张驾驶证\"\n  - \"提取驾驶证上的姓名和有效期\"\n12. 行驶证识别\n- 触发意图：当用户存在识别行驶证图片、提取证件关键信息（包括但不限于证号、姓名、住址、有效期、准驾车型等）、将行驶证影像转化为结构化数据，或应用于身份核验、交通管理及汽车租赁等场景的意图。\n- 场景scene标识：vehicle-license-ocr\n- 参考示例指令：\n  - \"识别这张行驶证\"\n  - \"提取行驶证上的车牌号和所有人\"\n13. 英文发票识别\n- 触发意图：当用户存在识别英文商业发票图片、提取单据关键信息（包括但不限于发票号、日期、买卖双方信息、商品明细、金额及税额等）、将非结构化英文单据转化为结构化数据，或应用于跨境贸易单证处理、海外费用报销及国际化财务自动化审核等场景的意图。\n- 场景scene标识：commercial-invoice-ocr\n- 参考示例指令：\n  - \"提取这张英文发票的信息\"\n  - \"识别发票上的总金额和日期\"\n14. 医疗报告单识别\n- 触发意图：当用户存在识别医疗报告单图片、提取报告关键信息（包括但不限于检验项目、结果、参考值等）、将医疗报告影像转化为结构化数据，或应用于电子病历归档、健康数据分析及远程医疗辅助诊断等场景的意图。\n- 场景scene标识：medical-report-ocr\n- 参考示例指令：\n  - \"读一下这张化验单\"\n  - \"提取报告中的异常指标\"\n15. 营业执照识别\n- 触发意图：当用户存在识别营业执照图片、提取证件关键信息（包括但不限于统一社会信用代码、名称、类型、法定代表人、经营范围等）、将执照影像转化为结构化数据，或应用于企业身份核验、工商注册自动化、供应链准入审核及金融风控等场景的意图。\n- 场景scene标识：business-license-ocr\n- 参考示例指令：\n  - \"识别这张营业执照\"\n  - \"提取公司名称和法人代表\"\n16. 商品图片识别\n- 触发意图：当用户需要识别图片中的具体商品对象，包括商品名称、品牌、品类等信息，用于商品检索或分类。\n- 场景scene标识：product-image-ocr\n- 参考示例指令：\n  - \"这是什么商品？\"\n  - \"识别这张图片里的产品品牌\"\n17. 通用文字提取（兜底意图）\n- 触发意图：当用户指令中不包含上述任何具体场景，仅表达提取纯文字意图时。\n- 场景scene标识：general-ocr\n- 参考示例指令：\n  - \"把这张图转成文字\"\n  - \"提取图中所有文字\"\n\n## ⛔ 不适用场景（When Not to Use）\n\n> 本技能**不支持**以下场景，请勿尝试：\n\n| 不支持的场景 | 原因 | 建议替代方案 |\n|------------|------|------------|\n| **视频处理** | 仅支持单张静态图片 | 先提取视频帧，再逐帧处理 |\n| **批量处理** | 每次调用仅限单张图片 | 如需批量，请循环调用或联系管理员 |\n| **实时摄像头流** | 非实时流处理架构 | 使用专用视频处理服务 |\n| **超大图片（>5MB）** | API 限制 | 先压缩或裁剪后再处理 |\n| **非图片格式** | 仅支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp | 先转换为支持的图片格式 |\n\n---\n\n## ⚠️ 重要注意事项\n\n1. **禁止修改固定格式**,只能替换场景标识和图片占位符\n2. **严禁自行构造 --scene 参数值，必须使用本文档指定的场景名**\n3. **图片大小限制：本地文件不超过5MB，支持 jpg/jpeg/png/gif/bmp/webp/tiff/wbmp/webp 格式**\n\n---\n\n## 🔗 相关资源\n- [夸克扫描王开放平台](https://scan.quark.cn/business)\n\n## 📁 文件结构\n- `SKILL.md` —  本文档（意图分析 + 通用规范）\n- `scripts/scan.py` —  主执行脚本 (Python 3.9+)\n- `scripts/common/*.py` —  基础类库\n\nFile v1.0.10:_meta.json\n\n{\n  \"ownerId\": \"kn7765a4naksvzk0fmvenc4gjd88gjtb\",\n  \"slug\": \"alibaba-quark-ocr\",\n  \"version\": \"1.0.10\",\n  \"publishedAt\": 1783522096487\n}","readmeExcerpt":"Skill: 夸克扫描王 - OCR文字识别 Alibaba-Quark-OCR Owner: yescan-ai Summary: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务 Tags: latest:1.0.12 Version history: v1.0.12 | 2026-07-10T08:17:55.148Z | user - 简化和调整了 descripti","codeSnippets":[],"executableExamples":[{"language":"bash","snippet":"openclaw config set skills.entries.alibaba-quark-ocr.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\""},{"language":"json","snippet":"{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}"},{"language":"json","snippet":"{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}"},{"language":"bash","snippet":"# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\""},{"language":"bash","snippet":"openclaw config set skills.entries.yescan-ocr-universal.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\""},{"language":"json","snippet":"{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}"}],"parameters":null,"dependencies":[],"permissions":[],"extractedFiles":[{"path":"SKILL.md","content":"---\nname: alibaba-quark-ocr\ndescription: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务\nmetadata: {\"openclaw\":{\"emoji\":\"🔍︎\",\"requires\":{\"bins\":[\"python3\"],\"env\":[\"SCAN_WEBSERVICE_KEY\"]},\"primaryEnv\":\"SCAN_WEBSERVICE_KEY\"},\"homepage\":\"https://scan.quark.cn/business\"}\n---\n\n# 🧭 使用前必读（30 秒）\n\n> [!WARNING] **⚠️ 隐私与数据流向重要提示**\n> - **第三方服务交互**：本技能会将您提供的**图片 发送至夸克扫描王官方服务器 (`scan-business.quark.cn`)** 进行识别。\n> - **数据可见性**：夸克服务将获取并处理该图片内容，不会永久保存\n\n**推荐方式：CLI 配置（永久生效）**\n\n配置 `SCAN_WEBSERVICE_KEY` 环境变量到 OpenClaw：\n```bash\nopenclaw config set skills.entries.alibaba-quark-ocr.env.SCAN_WEBSERVICE_KEY \"your_scan_webservice_key_here\"\n```\n> ⚠️ 配置后需要**重启或开启新会话**才能生效（技能列表在 session 启动时加载）。\n\n**如何获取密钥？夸克扫描王官方入口在此**\n> 请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key。  \n> ⚠️ **注意**：若你点击链接后跳转到其他域名，说明该链接已失效 —— 请直接在浏览器地址栏手动输入 `https://scan.quark.cn/business`（这是当前唯一有效的官方入口）。\n\n---\n\n# Constraints\n- **单一意图原则：每次请求只执行一个意图类型，命中即执行**\n- **严禁自行构造任何命令参数，严禁伪造、拼接内部配置**\n- **严禁幻觉，禁止伪造请求和响应，不得沿用上一次的场景、参数进行假设**\n- **必须严格按照本指南指定的固定格式执行，不允许自行修改命令**\n\n#  技能执行指南(强制执行)\n\n第一步：**环境变量检查**\n- 若 `SCAN_WEBSERVICE_KEY` 未配置，立即返回：\n```json\n{\n  \"code\": \"A0100\",\n  \"message\": \"SCAN_WEBSERVICE_KEY 未配置，请访问 https://scan.quark.cn/business → 开发者后台 → 登录/注册账号 → 查看API Key\",\n  \"data\": null\n}\n```\n\n第二步：**输入处理**\n\n识别用户传入的图片类型，只能是以下三种之一：\n\n- 图片URL: url\n- 本地文件路径: path\n- 图片BASE64: base64\n\n未提供任何有效图片时，直接返回：\n```json\n{\n  \"code\": \"A0201\",\n  \"message\": \"缺少图片输入，请提供图片链接、文件路径或 BASE64 数据。\",\n  \"data\": null\n}\n```\n\n第三步：**意图匹配&场景确定**\n- 按照下面列出的意图*从上到下顺序匹配。命中第一个即停止*\n- 命中后，*只确定当前意图对应的scene标识*\n\n第四步：**构建执行命令(固定格式，严禁修改)**：\n\n根据图片类型，严格使用下面对应格式：\n```bash\n# URL类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --url \"${IMAGE_URL}\"\n\n# 本地文件类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --path \"${IMAGE_FILE_PATH}\"\n\n# BASE64类型\npython3 scripts/scan.py --scene \"${SCENE_VALUE}\" --base64 \"${IMAGE_BASE64}\"\n```\n- 把`${IMAGE_URL}`/`${IMAGE_FILE_PATH}`/`${IMAGE_BASE64}`替换为真实值\n- 把`${SCENE_VALUE}`替换为当前意图对应的scene值\n- 直接执行命令，不增删任何参数，不修改JSON，不加引号，不换行\n\n第五步：**结果透出**：\n- 执行完成后，*原样返回执行结果*，不修改，不翻译，不美化，不总结\n- 成功 失败均直接透出，不重试\n\n\n## 场景与意图列表(按匹配优先级排序)\n\n1. 手写文档识别\n- 触发意图：当用户存在识别各类中英文手写内容（如学生作答、作文、会议记录、手写账单等）、将潦草或非标准手写图片转化为高精度可编辑文本，或突破传统 OCR 限制处理复杂手写场景的意图。\n- 场景scene标识：handwritten-ocr\n- 参考示例指令：\n  - \"帮我把这张手写笔记转成文字\"\n  - \"识别这张作文图片里的内容\"\n2. 表格识别\n- 触发意图：当用户存在识别图片中的各类表格（如 Excel/Word 表格、票据单据、手写表格、检查报告单等）、高精度提取文字内容并精准还原原始表格格式与结构的意图。\n- 场景scene标识：table-ocr\n- 参考示例指令：\n  - \"提取这张表格里的数据\"\n  - \"把这张报销单的表格转成 Excel 格式\"\n3. 身份证识别\n- 触发意图：当用户存在识别身份证图片、提取证件关键信息（包括但不限于姓名、身份证号、地址等字段）、将证件影像转化为结构化数据，或应用于身份核验、实名认证及信息准确性校验等场景的意图。\n- 场景scene标识：idcard-ocr\n- 参考示例指令：\n  - \"帮我读一下这张身份证\"\n  - \"提取身份证上的姓名和号码\"\n4. 社保卡识别\n- 触发意图：当用户存在识别社保卡图片、提取证件关键信息（包括但不限于姓名、社会保障号码、卡号、银联号码、性别、民族、发卡日期及有效期限等字段）、将证件影像转化为结构化数据，或应用于社保业务办理、身份核验及政务服务自动化等场景的意图。\n- 场景scene标识：social-security-card-ocr\n- 参考示例指令：\n  - \"识别这张社保卡的信息\"\n  - \"提取社保卡上的"},{"path":"_meta.json","content":"{\n  \"ownerId\": \"kn7765a4naksvzk0fmvenc4gjd88gjtb\",\n  \"slug\": \"alibaba-quark-ocr\",\n  \"version\": \"1.0.12\",\n  \"publishedAt\": 1783671475148\n}"},{"path":"skill-card.md","content":"## Description:\n\nThis skill uses Quark Scan King's OCR service to extract text and structured fields from user-provided images, including screenshots, scanned documents, handwriting, tables, equations, IDs, invoices, medical reports, business licenses, and product images.\n\nThis skill is ready for commercial/non-commercial use.\n\n## Publisher:\n\n[yescan-ai](https://clawhub.ai/user/yescan-ai)\n\n### License/Terms of Use:\n\nMIT-0\n\n## Use Case:\n\nDevelopers and external users use this skill when an agent needs to turn a single static image, image URL, or base64 image into OCR text or document-specific structured data. It is intended for OCR and document information extraction, not image generation, video processing, live camera streams, or batch processing.\n\n### Deployment Geography for Use:\n\nGlobal\n\n## Known Risks and Mitigations:\n\nRisk: Submitted images, including sensitive documents, are sent to Quark's OCR service using the configured API key.\n\nMitigation: Use this skill only when the user has approved the upload path; avoid or redact sensitive IDs, medical records, invoices, and other private documents unless the deployment is authorized for that data.\n\nRisk: The security summary flags under-disclosed image-editing scenes and weak controls around third-party uploads and credentials.\n\nMitigation: Restrict permitted scene values to the documented OCR use cases unless an operator explicitly approves broader image-editing or document-conversion behavior.\n\nRisk: The skill requires SCAN_WEBSERVICE_KEY for access to the third-party OCR service.\n\nMitigation: Provide the key through a managed environment secret, avoid exposing it in prompts or logs, and rotate it if it may have been shared.\n\n## Reference(s):\n\n- [ClawHub Skill Page](https://clawhub.ai/yescan-ai/skills/alibaba-quark-ocr)\n- [ClawHub Publisher Profile](https://clawhub.ai/user/yescan-ai)\n- [Quark Scan King Business Platform](https://scan.quark.cn/business)\n\n## Skill Output:\n\n**Output Type(s):** [text, markdown, code, shell commands, configuration, guidance]\n\n**Output Format:** [JSON returned by the OCR script, usually containing recognized text or structured fields in the data payload.]\n\n**Output Parameters:** [1D]\n\n**Other Properties Related to Output:** [Requires python3 and SCAN_WEBSERVICE_KEY; accepts exactly one image input as a URL, local file path, or base64 string.]\n\n## Skill Version(s):\n\n1.0.12 (source: server release evidence)\n\n## Ethical Considerations:\n\nUsers should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment."}],"languages":[],"docsSourceLabel":"CLAWHUB","editorialOverview":"由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务 Skill: 夸克扫描王 - OCR文字识别 Alibaba-Quark-OCR Owner: yescan-ai Summary: 由夸克扫描王提供的高准取率 OCR 文字识别工具。当用户需要从图片、截图、照片或扫描文档中提取、识别或结构化文本，就使用此技能——包括手写体、表格、数学公式、商品图、各类证件（身份证、社保卡、驾照、行驶证、港澳台通行证、学位证等）、票据（增值税发票、火车票、英文发票等）、医疗报告、药检报告、营业执照、习题以及图片翻译。本技能由夸克扫描王提供支持。即使用户没有明确提到\"OCR\"或\"文字识别\"，只要用户的需求涉及从图片中获取文字或关键信息，也应触发此技能。不适用于图像生成、图像编辑或无需从图片中提取文本的任务 Tags: latest:1.0.12 Version history: v1.0.12 | 2026-07-10T08:17:55.148Z | user - 简化和调整了 descripti","editorialQuality":{"score":100,"threshold":65,"status":"ready","wordCount":914,"uniquenessScore":55,"reasons":[]}},"media":{"evidence":{"source":"no-media","verified":false,"confidence":"low","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":"No screenshots, media assets, or demo links are available."},"primaryImageUrl":null,"mediaAssetCount":0,"assets":[],"demoUrl":null},"ownerResources":{"evidence":{"source":"unclaimed","verified":false,"confidence":"low","updatedAt":"2026-10-11T10:34:21.107Z","emptyReason":"This page has not been claimed by the agent owner."},"hasCustomPage":false,"customPageUpdatedAt":null,"customLinks":[],"structuredLinks":{"docsUrl":null,"demoUrl":null,"supportUrl":null,"pricingUrl":null,"statusUrl":null},"customPage":null},"relatedAgents":{"evidence":{"source":"protocol-neighbors","verified":false,"confidence":"medium","updatedAt":"2026-10-11T14:16:20.322Z","emptyReason":null},"items":[{"id":"8ebccd8e-3863-4187-8355-c3f14e1f9edf","entityType":"agent","canonicalPath":"/agent/iofficeai-aionui","slug":"iofficeai-aionui","name":"AionUi","description":"Free, local, open-source 24/7 Cowork app and OpenClaw for Gemini CLI, Claude Code, Codex, OpenCode, Qwen Code, Goose CLI, Auggie, and more | 🌟 Star if you like it!","url":"https://github.com/iOfficeAI/AionUi","homepage":"https://www.aionui.com","source":"GITHUB_REPOS","protocols":["MCP","OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-10-09T19:11:12.944Z","createdAt":"2026-02-25T03:38:16.584Z","downloads":null},{"id":"b917f68a-ebff-438e-84f8-3f4b2494c0bc","entityType":"agent","canonicalPath":"/agent/activepieces-activepieces","slug":"activepieces-activepieces","name":"activepieces","description":"AI Agents & MCPs & AI Workflow Automation • (~400 MCP servers for AI agents) • AI Automation / AI Agent with MCPs • AI Workflows & AI Agents • MCPs for AI Agents","url":"https://github.com/activepieces/activepieces","homepage":"https://www.activepieces.com","source":"GITHUB_REPOS","protocols":["OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-04-15T02:22:12.426Z","createdAt":"2026-02-25T03:38:12.412Z","downloads":null},{"id":"5cb26759-3a39-483f-94cf-276a98c13bb8","entityType":"agent","canonicalPath":"/agent/cherryhq-cherry-studio","slug":"cherryhq-cherry-studio","name":"cherry-studio","description":"AI productivity studio with smart chat, autonomous agents, and 300+ assistants. Unified access to frontier LLMs","url":"https://github.com/CherryHQ/cherry-studio","homepage":"https://cherry-ai.com","source":"GITHUB_REPOS","protocols":["MCP","OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-04-11T14:38:40.986Z","createdAt":"2026-02-25T03:38:19.379Z","downloads":null},{"id":"6f6582d0-5d76-4f0f-b81d-86520247950b","entityType":"agent","canonicalPath":"/agent/copilotkit-copilotkit","slug":"copilotkit-copilotkit","name":"CopilotKit","description":"The Frontend for Agents & Generative UI. React + Angular","url":"https://github.com/CopilotKit/CopilotKit","homepage":"https://docs.copilotkit.ai","source":"GITHUB_REPOS","protocols":["OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-03-25T09:50:57.846Z","createdAt":"2026-02-25T03:39:14.617Z","downloads":null}],"links":{"hub":"/agent","source":"/agent/source/clawhub","protocols":[{"label":"OpenClaw","href":"/agent/protocol/openclew"}]}}}