PDF万能大师
全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB" Skill: PDF万能大师 Owner: ford828 Summary: 全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB" Tags: latest:2.1.0 Version history: v2.1.0 | 2026-07-26T13:42:21.357Z | user - 引
Rank
62
Safety
84
Downloads
1.2k
Updated
Oct 10, 2026
Version
2.1.0
Source
CLAWHUB
About
What it does, and when to use it.
Capability contract not published. No trust telemetry is available yet. 1.2K downloads reported by the source. Last updated 10/10/2026.
Avoid when
- Contract metadata is missing or unavailable for deterministic execution.
Risk flags: missing_or_unavailable_contract, trust_data_unavailable, schema_references_missing
Public facts
Every fact links back to the source it came from.
- Vendor
- Clawhubvendor · observed Oct 10, 2026
- Protocol compatibility
- OpenClawcompatibility · observed Oct 10, 2026
- Adoption signal
- 1.2K downloadsadoption · observed Oct 10, 2026
- Latest release
- 2.1.0release · observed Jul 26, 2026
- Handshake status
- UNKNOWNsecurity
Install and run
Setup complexity: low.
clawhub skill install s17frrzcg4chdh4z6rnsntmhgd86c8vv:pdf-master- Setup complexity is LOW. This package is likely designed for quick installation with minimal external side-effects.
- Final validation: Expose the agent to a mock request payload inside a sandbox and trace the network egress before allowing access to real customer data.
Contract: missing
curl -s "https://www.xpersona.co/api/v1/agents/clawhub-ford828-pdf-master/snapshot"
Documentation
CLAWHUB
148,107 characters of source documentation, loaded on request.
Extracted files
5 files captured from the source.
SKILL.md
---
name: pdf-master
description: 全能 PDF 智能处理技能,覆盖 25 项能力五大核心(Office 高保真互转、扫描件 OCR、PDF 直接编辑、加密水印权限、批量合并拆分重命名)、九大增值(表格提取、图文解析、摘要、脱敏、元数据清洗、自动命名、版本对比、文档问答、规格对比矩阵)、四大扩展(智能压缩、排版保留翻译、合同风险审查、发票验真归档)、七大壁垒(电子签名审批流、批量内容替换、表单创建、图纸测量、翻页电子书、印刷级导出、密文级永久删除)。当用户上传 PDF 并提出转换、识别、编辑、加密、压缩、翻译、审查、归档、签名、替换、表单、测量、电子书、印刷、删除等需求,或提到"转Word""OCR""加水印""压缩到xxMB""审查合同""批量盖章""彻底删除"等指令时触发。飞书机器人场景原生支持。
license: MIT-0
metadata:
version: 2.1.0
openclaw:
requires:
bins: [python3]
optional_bins: [tesseract, libreoffice]
---
# 万能 PDF 大师
一站式 PDF 处理系统,25 项能力按四层组织。本文件是**路由与流程主控**:所有能力的详细执行规程、质量标准、错误降级、价值话术均在 `references/` 中按需加载。
---
## 核心工作流
每个请求严格按 5 步执行:
### Step 0: 环境闸门(首次使用或脚本报 ImportError 时)
运行 `python3 scripts/check_env.py` 查看能力就绪矩阵:
- 核心缺失 → 引导用户执行 `bash setup.sh`(或 `pip install -r requirements.txt`),装好再继续
- 增强项缺失 → 不阻断,按 `references/error-handling.md` 降级链执行并告知质量差异
- 环境齐备时跳过本步,不要每次请求都跑
### Step 1: 接收与检测
收到 PDF 后先运行 `scripts/pdf_info.py` 获取:页数、大小、加密状态、文本层有无、扫描件占比、元数据。**未检测不得开始处理。**
| 检测结果 | 路由 |
|---------|------|
| 有文本层 | 文本型管道(PyMuPDF / pdfplumber) |
| 无文本层、纯图像 | OCR 管道(先读 `references/ocr-config.md`) |
| 部分文本+部分图像 | 混合管道(文本页直取,图像页 OCR) |
| 加密文件 | 索要密码;无法提供则终止并说明 |
### Step 2: 意图路由
用「能力路由总表」匹配用户指令到能力编号。匹配规则:
1. **单意图命中** → 直接进入对应能力规程
2. **复合指令**(如"按日期重命名后合并成带目录的手册")→ 拆成能力链,按依赖顺序执行(重命名 #11 → 合并 #5),每步完成后汇报
3. **意图模糊**(如"处理一下这个文件")→ 列出最可能的 2-3 个能力让用户选择,**不得自行猜测执行**
4. **无法匹配** → 说明能力边界,推荐最接近的能力
20 个带标准路由的 Few-Shot 示例见 `references/few-shot-examples.md`,路由拿不准时先查它。
### Step 3: 执行前确认
以下情况必须先确认再动手:
- **批量任务**(>10 文件):报出文件数、预计耗时、将执行的操作清单
- **不可逆操作**(密文删除 #25、批量替换 #20、直接编辑 #3):展示预览/差异,等用户说"确认"
- **目标参数缺失**(压缩没说目标大小、改名没给规则):给出默认值并询问是否采用
### Step 4: 执行与进度反馈
- 确定性操作优先调用 `scripts/` 下脚本,不重复造轮子
- 长任务(>30 秒)每 20-30 秒发一次进度:"正在解析第 3/20 页…"
- 任一环节失败 → 按 `references/error-handling.md` 的降级链处理,**不得静默失败**
### Step 5: 交付与价值确认
交付时四件事缺一不可:
1. **结果文件**:上传文件 / 发文本 / 给多维表格链接
2. **质检结论**:按 `references/quality-standards.md` 对应能力的验收项自检并报告(如"表格 12 个全部原生可编辑,图片偏移 <5px")
3. **异常清单**:跳过的页、失败的文件、降级的环节,逐一明示
4. **价值反馈**:一句话省时/省钱/避险对比,话术从 `references/value-messaging.md` 取,不得编造数字
---
## 能力路由总表
**第一层 · 五大核心**(详细规程 `references/capabilities-core.md`)
| # | 能力 | 触发关键词 | 脚本 |
|---|------|-----------|------|
| 1 | PDF↔Office 高保真互转 | 转Word / 转Excel / 转PPT | `pdf_convert.py` |
| 2 | 扫描件 OCR 精准识别 | OCR / 识别 / 扫描件转文字 | `pdf_ocr.py` |
| 3 | PDF 内直接编辑 | 改文字 / 改参数 / 替换图片 | —(规程执行) |
| 4 | 安全保护(加密/权限/水印) | 加密 / 加水印 / 禁止打印 | `pdf_watermark.py` |
| 5 | 批量自动化处理 | 批量合并 / 拆分 / 重命名 | `pdf_merge.py` `pdf_split.py` |
**第二层 · 九大增值**(详细规程 `references/capabilities-value.md`)
| # | 能力 | 触发关键词 | 脚本 |
|---|------|-----------|------|
| 6 | 表格精准提取 | 提取表格 / 表格转Excel | `pdf_extract_tables.py` |
| 7 | 图文混排解析 | 提取图文 / 解析内容 | —(规程执行) |
| 8 | 智能摘要 | 摘要 / 总结 / 提炼重点 | —(LLM 执行) |
| 9 | 自动脱敏 | 脱敏 / 打码 / 隐藏敏感信息 | —(规程执行) |
| 10 | 元数据清洗 | 清洗元数据 / 擦除痕迹 | `pdf_info.py --scrub` |
| 11 | 名称/编号自动化 | 自动命名 / 重命名 | —(规程执行) |
| 12 | 两版差异对比 | 对比 / diff / 版本差异 | —(规程执行) |
| 13 | 文档即问即答 | 问答 / 这份文件说了什么 | —(RAG 规程) |
| 14 | 规格README.md
# 万能 PDF 大师(pdf-master) 一站式 PDF 智能处理技能:**25 项能力 · 4 层架构 · 10 个实测脚本 · 全套质量/安全护栏**。 不是功能堆砌,而是针对职场真实痛点的工程化解决方案——每项能力都有明确的执行规程、验收标准和降级策略。 ## 为什么选它 - **路由精准**:SKILL.md 内置「能力路由总表」+ 20 个 Few-Shot 示例,指令解析不猜测、不跑偏 - **执行稳定**:10 个高频能力脚本化(合并/拆分/OCR/压缩/水印/表格提取/密文删除/转换/批量替换/信息检测),输出可复现 - **质量可验**:25 项能力逐项合格线(如"表格原生可编辑、图片偏移 ≤5px、中文识别率 >95%"),交付必过质检 - **失败有兜底**:完整降级链(首选→降级→部分交付→明确终止),不静默失败、不伪造结果 - **安全有红线**:脱敏 vs 密文删除严格区分、CA 签名效力边界清晰、涉密文档本地模型路由、7 条红线清单 ## 能力总览(25 项) | 层 | 能力 | |----|------| | 五大核心 | ① Office 高保真互转 ② 扫描件 OCR ③ PDF 直接编辑 ④ 加密/权限/动态水印 ⑤ 批量合并拆分重命名 | | 九大增值 | ⑥ 表格提取 ⑦ 图文解析 ⑧ 智能摘要 ⑨ 自动脱敏 ⑩ 元数据清洗 ⑪ 自动命名 ⑫ 版本对比 ⑬ 文档问答 ⑭ 规格对比矩阵 | | 四大扩展 | ⑮ 智能压缩(目标大小迭代)⑯ 翻译保留排版 ⑰ 合同风险审查 ⑱ 发票验真归档 | | 七大壁垒 | ⑲ 电子签名审批流 ⑳ 批量内容替换(可回滚)㉑ 表单创建 ㉒ 图纸测量 ㉓ 翻页电子书 ㉔ 印刷级导出(CMYK/出血/转曲)㉕ 密文级永久删除(双引擎验证+删除证书) | ## 快速开始 ```bash # 1. 安装技能 clawhub install pdf-master # 2. 一键装依赖(幂等;装完自动自检,输出能力就绪矩阵) bash setup.sh # 核心依赖;--all 装全部增强项 # 也可手动:pip install -r requirements.txt # 3. 之后直接用自然语言: "把这份 PDF 转成 Word,表格要保持可编辑" "这 100 张发票帮我验真去重,生成报销单" "把 200 份报价单的 1999 改成 2199,先预览差异" "这份招标公告里的报价和联系方式彻底删除,不是涂黑" ``` ## 脚本速查(scripts/) | 脚本 | 用途 | |------|------| | `pdf_info.py` | 类型检测(文本/扫描/混合/加密)、元数据清洗 | | `pdf_merge.py` / `pdf_split.py` | 合并(带目录书签)/ 拆分(页范围/书签) | | `pdf_ocr.py` | 扫描件 → 可搜索 PDF(隐形文本层),PaddleOCR/Tesseract 双引擎 | | `pdf_compress.py` | 分层压缩到目标大小,质量地板保护文字清晰度 | | `pdf_watermark.py` | 动态水印(含中文)+ AES-256 加密 + 权限控制 | | `pdf_extract_tables.py` | 表格 → CSV/Excel | | `pdf_convert.py` | PDF → Word(pdf2docx)/ Excel | | `pdf_redact.py` | 密文级删除 + 双引擎验证 + 删除证书 | | `pdf_batch_replace.py` | 批量替换:预览 → 备份 → 执行 → 一键回滚 | ## 环境依赖 - 必需:`python3` + `pymupdf` `pdfplumber` `pikepdf` `pypdf` `pandas` `openpyxl` - 可选:`tesseract`(OCR 兜底)、`libreoffice`(复杂版面转换)、`pdf2docx` `paddleocr`(增强) ## 文档地图(references/) 能力规程(core/value/pro)· Few-Shot 路由示例 · 质量验收标准 · 错误降级策略 · 安全合规护栏 · 命令速查 · 价值话术库 · 技术规范 · OCR 调参 · 飞书集成 ## 许可证 MIT-0:任何人可自由使用、修改、再分发(含商业用途),无需署名。
_meta.json
{
"ownerId": "kn7f0d8egkxsnntb67gq7hrxzd86cwz5",
"slug": "pdf-master",
"version": "2.1.0",
"publishedAt": 1785073341357
}references/capabilities-core.md
# 核心能力规程(#1-#5)
> 执行对应能力前完整阅读本节。每项能力按「执行步骤 → 验收标准 → 常见坑」组织。
> 交付话术见 `value-messaging.md`,通用质检项见 `quality-standards.md`。
## 目录
- [#1 PDF↔Office 高保真互转](#1-pdfoffice-高保真互转)
- [#2 扫描件 OCR 精准识别](#2-扫描件-ocr-精准识别)
- [#3 PDF 内直接编辑](#3-pdf-内直接编辑)
- [#4 安全保护(加密/权限/水印)](#4-安全保护加密权限水印)
- [#5 批量自动化处理](#5-批量自动化处理)
---
## #1 PDF↔Office 高保真互转
**目标**:转换后排版还原度可编辑、可用,不是"能打开就行"。
### 执行步骤
1. `pdf_info.py` 检测文本层。扫描件 → 先走 #2 OCR 再转换,并告知用户多一步
2. 按目标格式选管道:
- **PDF→Word**:首选 `scripts/pdf_convert.py`(pdf2docx);复杂版面(多栏/嵌套表格/文本框密集)→ 走 LibreOffice 重建管道:`PDF → 提取元素 → 版面分析 → 生成原生 docx`
- **PDF→Excel**:只关心表格时直接用 #6 表格提取输出 xlsx;整页还原才走 pdf2docx 类管道
- **PDF→PPT**:一页一幻灯片,文本转文本框、图片原位嵌入;提醒用户 PPT 还原度天然低于 Word
3. 转换后自检(见下),不合格项降级重试一次,仍不合格如实列入异常清单
### 验收标准
| 项 | 合格线 |
|----|--------|
| 字体匹配 | ≥90% 文本保持原字体或视觉近似字体 |
| 表格 | 原生可编辑表格,非图片/文本框堆叠 |
| 图片位置 | 偏移 ≤5px |
| 页眉页脚 | 正确识别归位,不混入正文 |
### 常见坑
- 矢量图/SVG 元素转 Word 后变位图 → 提前告知
- 特殊字体(企业定制字体)本机缺失 → 用视觉近似字体并在交付时说明
- 竖排中文/日文 → pdf2docx 支持差,走 LibreOffice 管道
---
## #2 扫描件 OCR 精准识别
**目标**:可搜索、可复制、表格可重建。参数调优必读 `ocr-config.md`。
### 执行步骤
1. 预处理:纠偏 → 去噪 → 二值化(手机拍照件加对比度增强)
2. 引擎选择:中文/中英混排 → PaddleOCR;纯英文 → Tesseract 亦可;手写体 → PaddleOCR 手写模型
3. 按用户要的输出形态执行:
- **可搜索 PDF**:`scripts/pdf_ocr.py`,原图上叠隐形文本层,版式零改动
- **纯文本**:按阅读顺序拼接,保留段落结构
- **表格→Excel**:表格区域单独走结构化识别,重建行列(合并单元格语义判断)
4. 批量 >50 页自动分批,批间报进度
### 验收标准
| 项 | 合格线 |
|----|--------|
| 中文印刷体识别率 | >95%(抽 3 页人工比对关键字段) |
| 金额/日期/编号 | 100% 复核(正则校验格式 + 抽样目检) |
| 可搜索 PDF | 全文可搜索、可复制、选中位置准确 |
### 常见坑
- 公章覆盖文字 → 该区域识别率骤降,标注"低置信区"提醒用户核对
- 低分辨率(<150dpi)→ 先超分辨率或明确告知识别率上限
- 表格无框线 → 用坐标聚类重建,交付时附原页截图供比对
---
## #3 PDF 内直接编辑
**目标**:改字、换图、增删页,不动整体排版。**不可逆操作,执行前必须预览确认。**
### 执行步骤
1. 备份原文件(`.bak`),任何编辑都在副本上进行
2. 文本编辑:定位目标文本对象 → 以原字体/字号/颜色改写内容流;新文本比原文长 → 预警"可能溢出/换行",给两种方案(缩字号容纳 / 接受换行)让用户选
3. 图片替换:读取原图 bbox → 新图等比缩放到 bbox 内居中 → 保持原透明度/旋转
4. 页面操作:插入/删除/旋转/调序,操作后重排页码引用(目录、书签、交叉引用)
5. 生成修改前后对比预览图 → **用户确认后才交付正式文件**
### 验收标准
- 修改区域外零改动(diff 两版页面渲染图,仅目标区域有差异)
- 新文本无溢出、无遮挡、无乱码(字体子集缺失时用嵌入字体并说明)
### 常见坑
- 扫描件"改字":本质是修图不是改文本 → 告知用户走图像修复方案,效果上限先说清
- 加密/签名过的 PDF:编辑会破坏签名 → 明确告知并让用户确认是否继续
---
## #4 安全保护(加密/权限/水印)
### 执行步骤
1. 明确需求组合:密码 / 权限 / 水印 / 过期失效,缺参数给默认值并确认
2. 执行 `scripts/pdf_watermark.py`:
- 加密:AES-256,用户密码+所有者密码分离
- 权限粒度:禁止打印 / 禁止复制 / 禁止注释 / 禁止编辑,可组合
- 动态水印:支持变量 `{user_id}` `{date}` `{time}` `{custom}`,半透明(默认 15% 不透明度)、对角平铺整页、每页随机微偏移防批量裁剪
3. 输出受保护文件 + 一页《保护配置说明》(列明启用项与密码传递方式——密码绝不与文件同渠道发送)
### 验收标准
- 用无密码方式打开 → 拒绝;用错误密码 → 拒绝
- 权限项在主流阅读器(Adobe/WPS/浏览器)中生效验证
- 水印在 100%-400% 缩放下可读、不遮挡正文关键信息
### 常见坑
- 权限控制是"君子协定",流氓阅读器可绕过 → 必须如实告知用户,配合水印追溯才是完整方案
- 水印遮挡公章/签名区 → 默认避开页面四角 15% 区域,或由用户指定避让区
---
## #5 批量自动化处理
### 执行步骤
1. 清点文件清单(数量、总页数、总大小),>10 个文件先确认再执行
2. 按子能力选脚本:
- **合并**:`scripts/pdf_merge.py` —— 按文件名自然序或用户指定序;自动生成目录书签(每文件一章,取文件名/首页标题)
- **拆分**:`scripts/pdf_split.py` —— 支持按页范围 / 按书签 / 每 N 页一份;按内容拆分(如按章节标题)→ 先提取书签或标题模式再切
- **重命名**:从文档提取变量(标题/日期/编号)→ 模板如 `{date}_{title}_{no}` → **先输出新旧文件名对照表,确认后执行**
- **格式统一**:统一页面尺寸(A4/Letter)、页边距、页眉页脚
3. 失败文件单独列出,不混入成功批次;保留原文件不references/capabilities-pro.md
# 扩展与壁垒能力规程(#15-#25) > 执行对应能力前完整阅读本节。交付话术见 `value-messaging.md`,通用质检项见 `quality-standards.md`。 ## 目录 - [#15 PDF 智能压缩](#15-pdf-智能压缩) - [#16 PDF 翻译(保留排版)](#16-pdf-翻译保留排版) - [#17 合同智能审查](#17-合同智能审查) - [#18 发票/票据自动归档](#18-发票票据自动归档) - [#19 电子签名与审批流](#19-电子签名与审批流) - [#20 批量内容替换](#20-批量内容替换) - [#21 PDF 表单创建](#21-pdf-表单创建) - [#22 图纸精准测量](#22-图纸精准测量) - [#23 翻页电子书制作](#23-翻页电子书制作) - [#24 印刷级导出](#24-印刷级导出) - [#25 密文级敏感信息删除](#25-密文级敏感信息删除) --- ## #15 PDF 智能压缩 ### 执行步骤 1. 确认目标:指定大小("压到10MB")/ 场景预设(微信≤100MB、邮件≤25MB)/ 质量预设(清晰度优先) 2. 分层压缩策略(`scripts/pdf_compress.py` 内置):文字/矢量 → 无损保留;彩色图片 → JPEG 降采样(默认 150dpi/q70);扫描页 → 可选转 JBIG2 思路的位图优化;嵌入字体子集化;清理冗余对象 3. 目标大小模式:迭代降质直到 ≤ 目标值,每轮报参数;**设质量地板**(dpi 不低于 96、q 不低于 40),触底仍超 → 报告"极限压缩到 X MB",由用户决定是否接受更低画质 4. 输出压缩前后对比:大小、 dpi、关键页局部放大图(公章/签名/小字号区) ### 验收标准 - 文字区域:放大 200% 无模糊(文字未参与有损压缩) - 公章/签名/二维码可辨认、可扫描 - 线条图无肉眼可见锯齿;页数与内容零丢失 --- ## #16 PDF 翻译(保留排版) ### 执行步骤 1. 确认:目标语言 / 输出形态(纯译文 / 双语对照:左右、上下、段内三选一)/ 术语表(内置行业库或用户自定义) 2. 段落级提取(保留每段坐标、字号、字体粗细)→ 术语库预替换 → 调用翻译 → 译段回写原坐标 3. 排版回写规则:译文超长 → 先缩字号(最小到原 80%)→ 再允许换行扩框;CJK 与拉丁混排注意字距;图表内文字走图像文本替换 4. 生成《术语对照表》附交付 ### 验收标准 - 排版保留:版面结构、表格、图片位置与原文件一致(渲染图 diff 仅文字区域有差异) - 术语准确率 ≥95%(对照术语表全量核验);无漏译段落 - 双语版原文/译文逐段可对应 ### 常见坑 - 德/俄语译文平均膨胀 30% → 提前告知可能换行 - 扫描件 → 先 OCR 出文本层再翻译,告知多一步 - 公式/代码块不翻译,原位保留 --- ## #17 合同智能审查 ### 执行步骤 1. 确认审查立场(甲方/乙方/中立)与合同类型(采购/销售/劳动/合作/租赁),立场不同风险取向不同 2. 风险条款识别(六大类):自动续约 / 天价违约金 / 权利义务不对等 / 模糊表述 / 知识产权归属 / 数据隐私与保密 3. 输出《审查报告》固定结构: - `风险总览`(🔴高危/🟡中危/🟢低危 计数 + 一句话结论) - `逐条明细`:条款原文 → 页码定位 → 风险等级 → 风险解释 → 法律依据 → 修改建议(给出可直接替换的条款文本) - `缺失条款提醒`(该类合同应有而未有的条款) 4. 高亮标注版 PDF 一并交付 5. **免责边界**:报告结尾固定声明"本审查为 AI 辅助初筛,不替代执业律师意见;高危条款建议法务复核" ### 验收标准 - 六大类风险逐类扫描覆盖,无整类遗漏 - 每条风险有原文引用+页码,可点击核验;修改建议具体可执行,不说空话 --- ## #18 发票/票据自动归档 ### 执行步骤 1. 批量 OCR(发票专用模型):提取发票代码、号码、开票日期、金额、税额、价税合计、购买方/销售方名称与税号、发票类型 2. 验真:对接税务验真接口 → 逐张标记 真票/假票/作废/查无此票;**接口不可用时如实标记"未验真",严禁伪造验真结果** 3. 去重:发票代码+号码哈希;重复张列出对照 4. 输出:Excel 汇总表(按员工/部门/项目分类)+ 报销单 + 归档包(按 年/月 目录结构化重命名发票文件) 5. 异常清单:识别失败、验真异常、疑似连号/大额,单独列出 ### 验收标准 - 关键字段(号码/日期/价税合计)识别率 ≥98%,金额字段全量正则校验 - 验真状态逐张有结果(含"未验真"状态);去重 0 误杀(号码不同不判重) --- ## #19 电子签名与审批流 ### 执行步骤 1. 确认场景:单份签 / 批量盖章 / 多级审批流;确认签署方与顺序 2. 法律有效性路径:CA 数字证书签名(符合《电子签名法》第十三条);**无 CA 环境时只能做"图片章+留痕"**,必须明确告知法律效力差异 3. 批量盖章:AI 定位签署区("签字/盖章/甲方(盖章)"关键词+版式特征)→ 预览定位结果(逐份缩略图标出落章位置)→ 用户确认 → 批量执行,位置精度 ±2mm 4. 审批流引擎:顺序/并行/会签/条件分支;前级未签自动锁后级;每步记录 时间/IP/设备/证书编号 → 不可篡改审计日志 5. 签署完成后:文件哈希存证;任何后续修改会破坏签名并触发报警 6. 进度查询与签名验证作为子命令支持 ### 验收标准 - 落章位置预览确认率 100%(未确认不执行) - 审计日志逐步完整;签名验证报告可独立出具 - 法律效力表述准确:CA 证书签 vs 图片章,绝不混称 --- ## #20 批量内容替换 > 不可逆操作。备份 → 预览 → 确认 → 执行 → 报告,五步缺一不可。 ### 执行步骤 1. 规则确认:精确匹配 / 正则 / 图片哈希(换 Logo);多规则可同时下发 2. `scripts/pdf_batch_replace.py --dry-run` 生成《差异预览》:每文件命中位置、原文→新文、标记"可疑替换"(命中在表格/页眉/图片内等非常规区) 3. **用户确认后执行**:自动备份原件 → 批量替换(≤500/批)→ 失败文件单独列出 4. 《替换报告》:成功/失败/跳过计数、每文件命中数、备份位置、回滚指令 5. 回滚:`--rollback` 从备份恢复 ### 验收标准 - 预览命中率与执行结果一致;无误替换(可疑替换已逐一确认) - 替换区域外零改动;失败文件原件完好 --- ## #21 PDF 表单创建 ### 执行步骤 1. 字段检测:从 Word/PDF/图片识别填写区(下划线、"姓名:____"、空白框)→ 智能判型(文本/日期/数字/单选/复选/下拉
AionUi
Free, local, open-source 24/7 Cowork app and OpenClaw for Gemini CLI, Claude Code, Codex, OpenCode, Qwen Code, Goose CLI, Auggie, and more | 🌟 Star if you like it!
activepieces
AI Agents & MCPs & AI Workflow Automation • (~400 MCP servers for AI agents) • AI Automation / AI Agent with MCPs • AI Workflows & AI Agents • MCPs for AI Agents
cherry-studio
AI productivity studio with smart chat, autonomous agents, and 300+ assistants.
CopilotKit
The Frontend for Agents & Generative UI. React + Angular
Machine-readable data
The same record, as JSON, for agents and crawlers.
{
"facts": [
{
"factKey": "vendor",
"category": "vendor",
"label": "Vendor",
"value": "Clawhub",
"href": "https://clawhub.ai/ford828/skills/pdf-master",
"sourceUrl": "https://clawhub.ai/ford828/skills/pdf-master",
"sourceType": "profile",
"confidence": "medium",
"observedAt": "2026-10-10T22:52:42.065Z",
"isPublic": true
},
{
"factKey": "protocols",
"category": "compatibility",
"label": "Protocol compatibility",
"value": "OpenClaw",
"href": "https://www.xpersona.co/api/v1/agents/clawhub-ford828-pdf-master/contract",
"sourceUrl": "https://www.xpersona.co/api/v1/agents/clawhub-ford828-pdf-master/contract",
"sourceType": "contract",
"confidence": "medium",
"observedAt": "2026-10-10T22:52:42.065Z",
"isPublic": true
},
{
"factKey": "traction",
"category": "adoption",
"label": "Adoption signal",
"value": "1.2K downloads",
"href": "https://clawhub.ai/ford828/pdf-master",
"sourceUrl": "https://clawhub.ai/ford828/pdf-master",
"sourceType": "profile",
"confidence": "medium",
"observedAt": "2026-10-10T22:52:42.065Z",
"isPublic": true
},
{
"factKey": "latest_release",
"category": "release",
"label": "Latest release",
"value": "2.1.0",
"href": "https://clawhub.ai/ford828/pdf-master",
"sourceUrl": "https://clawhub.ai/ford828/pdf-master",
"sourceType": "release",
"confidence": "medium",
"observedAt": "2026-07-26T13:42:21.357Z",
"isPublic": true
},
{
"factKey": "handshake_status",
"category": "security",
"label": "Handshake status",
"value": "UNKNOWN",
"href": "https://www.xpersona.co/api/v1/agents/clawhub-ford828-pdf-master/trust",
"sourceUrl": "https://www.xpersona.co/api/v1/agents/clawhub-ford828-pdf-master/trust",
"sourceType": "trust",
"confidence": "medium",
"observedAt": null,
"isPublic": true
}
],
"events": [
{
"eventType": "release",
"title": "Release 2.1.0",
"description": "- 引入环境自检逻辑,新增 Step 0:首次使用或缺依赖时报错时自动检测环境,缺失核心依赖时引导用户用 setup.sh 一键安装 - 添加 LICENSE(MIT-0)、README.md 和环境脚本,完善开源合规与部署说明 - 支持能力就绪矩阵检查,缺增强依赖时自动降级并告知质量影响 - 完善元数据声明和依赖要求,新增 requirements.txt、requirements-optional.txt - 统一入口,引导读者使用 bash setup.sh 完成部署,去除 skill-card.md",
"href": "https://clawhub.ai/ford828/pdf-master",
"sourceUrl": "https://clawhub.ai/ford828/pdf-master",
"sourceType": "release",
"confidence": "medium",
"observedAt": "2026-07-26T13:42:21.357Z",
"isPublic": true
}
]
}Record generated Oct 11, 2026.
