{"id":"a7bb56ce-ce3a-46ec-817c-adfd5c4ba597","entityType":"agent","slug":"clawhub-helloo1568-image-ppt","name":"image-ppt","canonicalUrl":"https://www.xpersona.co/agent/clawhub-helloo1568-image-ppt","canonicalPath":"/agent/clawhub-helloo1568-image-ppt","generatedAt":"2026-10-10T06:43:10.755Z","source":"CLAWHUB","claimStatus":"UNCLAIMED","verificationTier":"NONE","summary":{"evidence":{"source":"editorial-content","verified":true,"confidence":"high","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":null},"description":"图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。 Skill: image-ppt Owner: helloo1568 Summary: 图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。 Tags: latest:0.1.0 Version history: v0.1.0 | 2026-08-08T02:23:48.967Z | auto Initial release of image-ppt skill. - Pr","descriptionLabel":"Technical summary","evidenceSummary":"Capability contract not published. No trust telemetry is available yet. 2.4K downloads reported by the source. Last updated 10/9/2026.","installCommand":"clawhub skill install s170k0whretfv2jwycpr3epm0x8c3n40:image-ppt","sourceUrl":"https://clawhub.ai/helloo1568/image-ppt","homepage":"https://clawhub.ai/helloo1568/skills/image-ppt","primaryLinks":[{"label":"View on ClawHub","url":"https://clawhub.ai/helloo1568/image-ppt","kind":"source"},{"label":"Homepage","url":"https://clawhub.ai/helloo1568/skills/image-ppt","kind":"homepage"}],"safetyScore":84,"overallRank":62,"popularityScore":68,"trustScore":null,"claimedByName":null,"isOwner":false,"seoDescription":"图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演"},"coverage":{"evidence":{"source":"public-profile","verified":false,"confidence":"medium","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":null},"protocols":[{"protocol":"OPENCLEW","label":"OpenClaw","status":"self-declared","notes":"Declared in the public agent profile."}],"capabilities":[],"verifiedCount":0,"selfDeclaredCount":1,"capabilityMatrix":{"rows":[{"key":"OPENCLEW","type":"protocol","support":"unknown","confidenceSource":"profile","notes":"Listed on profile"}],"flattenedTokens":"protocol:OPENCLEW|unknown|profile"}},"adoption":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"medium","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":null},"stars":null,"forks":null,"downloads":2380,"packageName":null,"latestVersion":"0.1.0","tractionLabel":"2.4K downloads"},"release":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"medium","updatedAt":"2026-10-09T15:36:08.502Z","emptyReason":null},"lastUpdatedAt":"2026-10-09T15:36:08.503Z","lastCrawledAt":"2026-10-09T15:36:08.502Z","lastIndexedAt":null,"nextCrawlAt":"2026-10-10T15:36:08.502Z","lastVerifiedAt":null,"highlights":[{"version":"0.1.0","createdAt":"2026-08-08T02:23:48.967Z","changelog":"Initial release of image-ppt skill. - Provides a 3-step workflow to convert books, PDFs, or text materials into editable, high-quality PPT presentations. - Platform-agnostic methodology using three core prompt templates for content summarization, design, image-based PPT generation, and editable PPT reconstruction. - Step-by-step guide supports various AI assistants (Codex + GPT-Image 2.0 recommended) for flexible execution. - Includes clear adaptation suggestions for different AI platforms and tools. - Suitable for class reports, book sharing, meetings, project presentations, and competitions. - Core prompts provided in references/prompts.md for modular use.","fileCount":9,"zipByteSize":18934}]},"execution":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No published capability contract is available yet."},"installCommand":"clawhub skill install s170k0whretfv2jwycpr3epm0x8c3n40:image-ppt","setupComplexity":"low","setupSteps":["Setup complexity is LOW. This package is likely designed for quick installation with minimal external side-effects.","Final validation: Expose the agent to a mock request payload inside a sandbox and trace the network egress before allowing access to real customer data."],"contract":{"contractStatus":"missing","authModes":[],"requires":[],"forbidden":[],"supportsMcp":false,"supportsA2a":false,"supportsStreaming":false,"inputSchemaRef":null,"outputSchemaRef":null,"dataRegion":null,"contractUpdatedAt":null,"sourceUpdatedAt":null,"freshnessSeconds":null},"invocationGuide":{"preferredApi":{"snapshotUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/snapshot","contractUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/contract","trustUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/trust"},"curlExamples":["curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/snapshot\"","curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/contract\"","curl -s \"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/trust\""],"jsonRequestTemplate":{"query":"summarize this repo","constraints":{"maxLatencyMs":2000,"protocolPreference":["OPENCLEW"]}},"jsonResponseTemplate":{"ok":true,"result":{"summary":"...","confidence":0.9},"meta":{"source":"CLAWHUB","generatedAt":"2026-10-10T06:43:10.754Z"}},"retryPolicy":{"maxAttempts":3,"backoffMs":[500,1500,3500],"retryableConditions":["HTTP_429","HTTP_503","NETWORK_TIMEOUT"]}},"endpoints":{"dossierUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/dossier","snapshotUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/snapshot","contractUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/contract","trustUrl":"https://www.xpersona.co/api/v1/agents/clawhub-helloo1568-image-ppt/trust"}},"reliability":{"evidence":{"source":"runtime-metrics","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No trust, reliability, or runtime telemetry is available."},"trust":{"status":"unavailable","handshakeStatus":"UNKNOWN","verificationFreshnessHours":null,"reputationScore":null,"p95LatencyMs":null,"successRate30d":null,"fallbackRate":null,"attempts30d":null,"trustUpdatedAt":null,"trustConfidence":"unknown","sourceUpdatedAt":null,"freshnessSeconds":null},"decisionGuardrails":{"doNotUseIf":["Contract metadata is missing or unavailable for deterministic execution."],"safeUseWhen":[],"riskFlags":["missing_or_unavailable_contract","trust_data_unavailable","schema_references_missing"],"operationalConfidence":"low"},"executionMetrics":{"observedLatencyMsP50":null,"observedLatencyMsP95":null,"estimatedCostUsd":null,"uptime30d":null,"rateLimitRpm":null,"rateLimitBurst":null,"lastVerifiedAt":null,"verificationSource":null},"runtimeMetrics":{"successRate":null,"avgLatencyMs":null,"avgCostUsd":null,"hallucinationRate":null,"retryRate":null,"disputeRate":null,"p50Latency":null,"p95Latency":null,"lastUpdated":null}},"benchmarks":{"evidence":{"source":"no-benchmark-data","verified":false,"confidence":"low","updatedAt":null,"emptyReason":"No benchmark suites or observed failure patterns are available."},"suites":[],"failurePatterns":[]},"artifacts":{"evidence":{"source":"CLAWHUB","verified":false,"confidence":"high","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":null},"readme":"Skill: image-ppt\n\nOwner: helloo1568\n\nSummary: 图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。\n\nTags: latest:0.1.0\n\nVersion history:\n\nv0.1.0 | 2026-08-08T02:23:48.967Z | auto\n\nInitial release of image-ppt skill.\n\n- Provides a 3-step workflow to convert books, PDFs, or text materials into editable, high-quality PPT presentations.\n- Platform-agnostic methodology using three core prompt templates for content summarization, design, image-based PPT generation, and editable PPT reconstruction.\n- Step-by-step guide supports various AI assistants (Codex + GPT-Image 2.0 recommended) for flexible execution.\n- Includes clear adaptation suggestions for different AI platforms and tools.\n- Suitable for class reports, book sharing, meetings, project presentations, and competitions.\n- Core prompts provided in references/prompts.md for modular use.\n\nArchive index:\n\nArchive v0.1.0: 9 files, 18934 bytes\n\nFiles: LICENSE (1069b), manifest.yaml (1414b), README.en.md (8441b), README.md (8650b), references (0b), references/prompts.md (6930b), skill-card.md (2188b), SKILL.md (10104b), _meta.json (128b)\n\nFile v0.1.0:SKILL.md\n\n---\nname: image-ppt\ndescription: \"图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。\"\nagent_created: true\n---\n\n# 图片PPT — 文字材料转可编辑PPT工作流（通用方法论）\n\n## Overview\n\n本技能提供一套完整的三步工作流，将书籍 PDF、论文、报告等文字材料转化为精美且可编辑的 PowerPoint 演示文稿。工作流源自小黑盒社区教程（作者：玩家22186848），参考 B 站 UP 主「一往无前河井」的学术 PPT 制作思路，经泛化后适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等多种场景。\n\n**推荐运行环境：Codex + GPT-Image 2.0。** Codex 负责文档读取、流程编排与 PPTX 拼装/还原（shell + python-pptx 一条龙）；GPT-Image 2.0 负责绘制风格统一、文字精准的 PPT 页面。Step 1/2 的提示词中\"image2图像生成模型\"在 Codex 环境对应 **GPT-Image 2.0**，在 GPT/ChatGPT 环境对应其原生图像模型，在其他环境替换为实际使用的生图工具。\n\n**平台无关**：这套方法论的核心是三段提示词 + 三步流程，可在任何具备「文档读取、图像生成、文件输出」能力的 AI 助手中使用（Codex、ChatGPT/GPT、Claude、Kimi、豆包、WorkBuddy、通义等）。执行时仅需将文中标注的通用能力映射到你当前使用的 AI 工具即可。\n\n三段核心提示词存放于 `references/prompts.md`，按步骤引用。\n\n## Workflow Decision Tree\n\n```\n用户输入文字材料（PDF / 书籍 / 论文 / 报告 / 纯文本）\n         │\n         ▼\n  ┌──────────────┐\n  │ Step 1       │  内容提炼 + 风格设计\n  │ 读懂材料      │  → 提炼核心内容\n  │ 生成4套预览   │  → 生成4套风格预览图\n  └──────┬───────┘\n         │ 用户选定一套风格\n         ▼\n  ┌──────────────┐\n  │ Step 2       │  图片版PPT生成\n  │ 逐页生成图片  │  → 按选定风格逐页生成\n  │ 合并为PPTX    │  → 合并为可下载 .pptx\n  └──────┬───────┘\n         │ 得到图片版PPT（不可编辑）\n         ▼\n  ┌──────────────┐\n  │ Step 3       │  可编辑化还原\n  │ 逐页拆解还原  │  → 图片层 + 可编辑文字层\n  │ 输出可编辑PPTX│  → 输出可编辑 .pptx\n  └──────────────┘\n```\n\n## Step 1: 内容提炼与风格设计\n\n### 目标\n\n深入阅读并理解源材料，提炼核心内容；同时生成四套不同风格的 PPT 缩略预览图供用户选择。\n\n### 执行步骤\n\n1. **读取源材料**：读取用户提供的 PDF/文档。长文档分段读取并汇总要点。\n2. **提炼内容大纲**：从材料中提取以下要素：\n   - 作者背景、写作背景\n   - 全书/全文结构\n   - 主要观点、重点章节\n   - 典型案例、经典语句\n   - 现实意义与阅读启示\n3. **获取参考风格**：询问用户是否有参考 PPT 模板图片。如有，分析该图片的配色、字体、版式风格。\n4. **生成四套风格预览**：使用 AI 的图像生成能力，按 `references/prompts.md` 中的 **Prompt 1** 生成四套不同风格的 PPT 缩略预览图（类似幻灯片浏览视图布局）。四套方案内容结构一致，但主题颜色、排版方式和视觉风格需有区别。\n5. **暂停等待用户选择**：展示四套预览图，请用户选定其中一套风格。\n\n### 适配说明\n\n- **Codex（推荐）**：用文档读取能力提炼内容，再调用图像生成（推荐 GPT-Image 2.0）生成预览图。Prompt 1 中的\"image2图像生成模型\"对应 GPT-Image 2.0。\n- **具备原生图像生成能力的 AI（如 GPT）**：直接将源材料 PDF + 参考风格图片 + Prompt 1 一起发送，AI 会调用其图像模型生成预览。\n- **通过外部工具生图的 AI（如 Claude、WorkBuddy）**：先用文档读取能力提炼内容，再调用可用的生图工具生成预览图。Prompt 1 中的\"image2图像生成模型\"替换为实际使用的生图工具。\n\n## Step 2: 生成完整图片版PPT\n\n### 目标\n\n根据用户选定的风格模板，逐页生成完整的 PPT 页面图片，并合并为可下载的 .pptx 文件。\n\n### 执行步骤\n\n1. **确认风格选择**：记录用户在 Step 1 中选定的风格编号。\n2. **逐页生成图片**：基于选定的风格模板和 Step 1 提炼的内容大纲，逐页生成 PPT 页面图片。每页突出一个核心观点，避免大段文字堆砌。\n3. **合并为 PPTX**：将所有页面图片按顺序嵌入 16:9 幻灯片，生成 .pptx 文件（可借助 PPT 生成器、python-pptx 脚本或 AI 自带的文件输出能力）。\n4. **交付文件**：将生成的 .pptx 文件交付给用户。\n\n### 适配说明\n\n- **Codex（推荐）**：循环调用图像生成（推荐 GPT-Image 2.0）逐页绘制，再用 python-pptx 脚本合并为 .pptx。Prompt 2 中的\"image2图像生成图片\"对应 GPT-Image 2.0。\n- **具备原生图像生成能力的 AI（如 GPT）**：发送 Prompt 2（见 `references/prompts.md`），AI 会逐页生成并自动合并为 pptx。\n- **通过外部工具生图的 AI**：手动编排——先循环调用生图工具生成每页图片，再用 PPT 生成器或 python-pptx 脚本合并。注意部分 AI 单次对话只能调用一次工具，需分多轮完成所有页面生成。\n\n### 注意事项\n\n- 单次生图调用通常只能生成一张图片，多页 PPT 需要循环调用。\n- 生成顺序建议：封面 → 目录 → 各内容页 → 总结页 → 致谢页。\n- 每页生成时需在 prompt 中包含：选定风格描述 + 该页具体内容要点 + 页码信息。\n\n## Step 3: 图片版PPT还原为可编辑PPTX\n\n### 目标\n\n将 Step 2 产出的图片版 PPT（每页是一整张图片，不可编辑）还原为可编辑的 PPTX 文件，保留视觉质感的同时让主要文字可编辑。\n\n### 执行步骤\n\n1. **逐页处理**：将图片版 PPT 的每一页单独处理，每次最多处理 1-3 页，避免拆分效果下降。\n2. **识别页面结构**：分析每页图片，将内容拆分为两个层次：\n   - **复杂视觉资产层**：品牌Logo、人物、插画、3D图、复杂背景、复杂图表等 → 裁切/提取为高清图片嵌入\n   - **可编辑信息层**：标题、副标题、正文、金句、关键数字、结论框文字、页码等 → 用 PPT 原生文本框重建\n3. **文字还原**：将可编辑文字用 PPT 原生文本框重新制作，匹配原图的字体气质、字号层级、字重、颜色、行距、字距、对齐方式和位置。如需覆盖原图文字，先用背景色/局部遮罩遮盖原文字，再叠加新文本框，避免重影。\n4. **视觉还原**：保持原图的版式比例、视觉重心、阅读顺序、留白节奏、颜色、对比度、明暗关系。\n5. **输出与对照**：输出 16:9 可编辑 PPTX，同时渲染预览图与原图对照。如存在明显差距，继续迭代修改。\n6. **交付说明**：完成后说明哪些元素被还原为可编辑文本、哪些保留为图片、是否存在字体替代。\n\n### 还原指令\n\n完整的逐页还原提示词见 `references/prompts.md` 中的 **Prompt 3**。该提示词采用\"复杂视觉保真 + 主要文字可编辑\"的混合还原策略。\n\n### 适配说明\n\n- **具备原生图像拆解能力的 AI（如 GPT）**：上传图片版PPT + 发送 Prompt 3，AI 的图像功能可拆解组合图层元素，直接输出可编辑 PPTX。\n- **Codex（推荐）**：\n  1. 查看每页图片，识别文字内容和视觉元素结构\n  2. 用图像处理库（如 Pillow）裁切复杂视觉区域为独立图片\n  3. 用 python-pptx 或 pptxgenjs 构建 PPTX：背景图铺底 + 原生文本框叠加文字\n  4. 逐页处理，每次 1-3 页\n  5. 合并所有页面为最终 .pptx\n- **其他 AI（如 Claude、WorkBuddy）**：按上述 Codex 路径，将具体库/工具替换为当前环境可用者即可。\n\n### 关键注意事项\n\n- **一页一页拆**：每次最多处理 3 页，否则拆分元素效果不理想。\n- **避免双重显示**：如果原图本身已含文字，必须先用背景色覆盖原文字再叠加文本框，否则会出现文字重影。\n- **字体替代**：无法识别原图字体时，中文选用黑体/思源黑体/微软雅黑，英文选用最接近的无衬线/衬线字体。\n- **复杂视觉区域中的小字**：如果单独拆分会破坏画面质感，可保留为图片，但需在最终说明中标注。\n\n## Resources\n\n### references/\n- `prompts.md` — 三段核心提示词原文（Prompt 1: 内容提炼与风格设计 / Prompt 2: 图片版PPT生成 / Prompt 3: 可编辑PPTX还原）\n\n### 工具映射建议\n\n执行时按当前 AI 环境选择对应能力：\n\n| 通用能力 | 可用的工具/技能示例 |\n|---------|-------------------|\n| 文档读取 | 内置 PDF/文档阅读、MarkItDown、任何文件解析能力 |\n| 图像生成 | 原生图像模型（如 GPT Image）、Agnes、Midjourney、即梦、通义万相等 |\n| PPTX 构建 | AI 自带文件输出、python-pptx、pptxgenjs、WPS/Office 插件 |\n\n## 适用场景\n\n| 场景 | 说明 |\n|------|------|\n| 大学课堂小组汇报 | 读书分享、课程作业汇报 |\n| 组会汇报 | 文献汇报、研究进展汇报 |\n| 项目汇报 | 项目总结、方案展示 |\n| 比赛路演 | 创业计划书、项目路演 |\n| 读书分享会 | 书籍内容提炼与分享 |\n\nFile v0.1.0:README.md\n\n# 图片PPT Skill · 文字材料转可编辑PPT\n\n![GitHub stars](https://img.shields.io/github/stars/helloo1568/image-ppt?style=flat-square)\n![License](https://img.shields.io/github/license/helloo1568/image-ppt?style=flat-square)\n![Skill](https://img.shields.io/badge/Skill-Agent-111111?style=flat-square)\n![Codex](https://img.shields.io/badge/Codex-Recommended-222222?style=flat-square)\n![GPT-Image 2.0](https://img.shields.io/badge/GPT--Image%202.0-Recommended-0A7CFF?style=flat-square)\n\n> 🌏 **English version: [README.en.md](./README.en.md)**\n\n一个适配 **Codex / Claude Code 等 Agent 环境**的 PPT 生成技能：把书籍、PDF 或任意文字材料，变成**精美且可编辑的 PPTX**，而不是一张张没法改的图片。\n\n**推荐运行环境：Codex + GPT-Image 2.0**。Codex 负责读懂文档、编排流程、拼装文件；GPT-Image 2.0 负责绘制风格统一、文字精准的 PPT 页面。\n\n## 为什么推荐 Codex + GPT-Image 2.0\n\n| 环节 | 推荐工具 | 为什么 |\n|------|---------|--------|\n| 文档理解与流程编排 | **Codex** | 有 shell 权限，能读长文档、循环生图、自动合并/还原 PPTX，一次跑完三步流程 |\n| 页面绘制 | **GPT-Image 2.0** | 像素级文字渲染、跨页风格一致、商业级排版，能精确还原模板气质 |\n| PPTX 拼装 | Codex + python-pptx | 图片页按 16:9 顺序嵌入，输出可下载 .pptx |\n\n> 本技能也兼容其他具备「文档读取 + 图像生成 + 文件输出」能力的 AI 助手（GPT、Claude、Kimi、豆包、WorkBuddy 等），按提示词中的适配说明取用即可。\n\n## 三步工作流\n\n```\n源材料（PDF / 书籍 / 文字）\n    │\n    ▼\n① 内容提炼 + 风格设计   读懂材料、提炼大纲，生成 4 套风格预览供选择\n    │\n    ▼\n② 图片版 PPT 生成       按选定风格逐页绘制，合并为可下载 .pptx\n    │\n    ▼\n③ 可编辑 PPTX 还原      逐页拆解为「复杂视觉保真 + 文字可编辑」的 PPTX\n```\n\n## 30 秒开始\n\n直接把这段话发给有 shell 权限的 AI Agent（推荐 Codex）：\n\n```text\n帮我安装 image-ppt 技能。请把 https://github.com/helloo1568/image-ppt 克隆到本地技能目录，\n安装完成后检查 SKILL.md、references/ 是否存在。装好后我说\"帮我把这本书做成 PPT\"就会触发它。\n```\n\n安装后直接对 Agent 说：\n\n```text\n帮我把这份 PDF 做成课堂汇报 PPT，先按提示词生成 4 套风格预览，我选一套再继续。\n```\n\n也可以试这些请求：\n\n```text\n帮我把这本书做成读书分享 PPT，配图用 GPT-Image 2.0 生成。\n把这份报告做成组会汇报 PPT，参考我上传的模板风格。\n图片PPT：把这份 Markdown 变成 16:9 可编辑 PPTX。\n```\n\n## 效果\n\n- 🧠 **读懂材料**：自动提炼作者背景、全书结构、主要观点、典型案例、经典语句与现实意义\n- 🎨 **四套风格预览**：生成 4 套不同配色/排版/视觉风格的缩略图，选定后再开工\n- 🖼 **逐页绘制**：每页突出一个核心观点，配结构图、时间轴、人物关系图等可视化\n- 📦 **可编辑 PPTX**：复杂视觉保留为高清图片，主要文字还原为 PPT 原生文本框\n- 🔁 **逐页迭代**：每次还原 1-3 页，先确认一页质量再批量推进\n\n## 适合 / 不适合\n\n**✅ 合适**：大学课堂小组汇报 / 读书分享 / 组会文献汇报 / 项目汇报 / 比赛路演 / 课程作业\n\n**❌ 不合适**：需要多人实时协作编辑的文档（建议直接用 Office 在线协作）、大段表格数据型汇报（图片版信息密度有限）\n\n## 常见使用场景\n\n| 任务 | 推荐方式 |\n|------|---------|\n| 一本书变成读书分享 PPT | 三步全流程，重点提炼核心观点与金句 |\n| 论文 / 文献做组会汇报 | 用 Prompt 1 提炼结构，配流程图、关系图 |\n| 课程作业 / 课堂展示 | 参考模板图 + 四套风格预览，快速定稿 |\n| 比赛路演 / 项目汇报 | 突出结论与亮点页，控制页数与节奏 |\n| 已有图片版 PPT 要改文字 | 直接用 Prompt 3 逐页还原为可编辑 PPTX |\n\n## 平台支持\n\n| 平台 | 状态 | 说明 |\n|------|------|------|\n| **Codex** | 推荐 | 完整跑通三步流程：读文档、GPT-Image 2.0 生图、python-pptx 拼装/还原 |\n| Claude Code | 可用 | 文本/编排能力强；生图需接入外部图像工具 |\n| GPT / ChatGPT | 可用 | 原生图像能力，直接粘贴三段提示词即可 |\n| WorkBuddy | 可用 | 支持文档读取与本地工具链，按适配说明执行 |\n| Kimi / 豆包 / 通义 | 部分可用 | 需自行确认其图像生成与文件输出能力 |\n\n## 安装\n\n### 方式一：一行命令安装（推荐）\n\n```bash\nnpx skills add https://github.com/helloo1568/image-ppt --skill image-ppt\n```\n\n### 方式二：发给 AI 自动安装\n\n> 帮我安装 `image-ppt` 这个 skill。按下面步骤做：\n>\n> 1. 确保本地技能目录存在（`~/.claude/skills/` 或 `~/.codex/skills/`，不存在就创建）\n> 2. 执行 `git clone https://github.com/helloo1568/image-ppt.git <技能目录>/image-ppt`\n> 3. 验证 `SKILL.md`、`references/prompts.md` 存在\n> 4. 告诉我安装好了，之后我说\"做一份 PPT\"之类的话就会触发\n\n### 方式三：手动克隆\n\n```bash\ngit clone https://github.com/helloo1568/image-ppt.git ~/.claude/skills/image-ppt\n# 或放入 Codex 技能目录\ngit clone https://github.com/helloo1568/image-ppt.git ~/.codex/skills/image-ppt\n```\n\n### 触发方式\n\n装好后 Agent 会在对话里自动发现并调用。触发关键词：\n\n- \"帮我把这本书做成 PPT\"\n- \"把这份 PDF 做成课堂汇报 PPT\"\n- \"图片PPT 生成读书分享演示文稿\"\n- \"基于这份材料做一份可编辑 PPTX\"\n- \"image-ppt\"\n\n## 使用流程\n\nSkill 是结构化工作流，Agent 会逐步引导：\n\n1. **读懂材料** — 读取 PDF/文档，提炼作者背景、结构、观点、案例、金句与现实意义\n2. **风格设计** — 询问是否有参考模板图，用 GPT-Image 2.0 生成 4 套风格预览\n3. **用户选择** — 展示预览，等待选定一套风格\n4. **逐页生成** — 按选定风格逐页绘制（封面 → 目录 → 内容页 → 总结 → 致谢）\n5. **合并 PPTX** — 图片页按 16:9 顺序嵌入，输出可下载 .pptx\n6. **可编辑还原** — 逐页拆解（每次 1-3 页）：复杂视觉转图片、主要文字转原生文本框\n7. **对照迭代** — 渲染预览与原图对照，明显差距继续迭代\n8. **交付说明** — 说明哪些是可编辑文本、哪些保留为图片、字体替代情况\n\n详细说明见 [`SKILL.md`](./SKILL.md)，三段核心提示词见 [`references/prompts.md`](./references/prompts.md)。\n\n## 目录结构\n\n```\nimage-ppt/\n├── SKILL.md              ← Skill 主文件：三步工作流与适配说明\n├── README.md             ← 本文件（中文）\n├── README.en.md          ← English version\n├── manifest.yaml         ← 技能清单（版本、触发词、安全声明）\n└── references/\n    └── prompts.md        ← 三段核心提示词（可直接复制使用）\n```\n\n## 核心提示词\n\n三段提示词直接可用，详见 [`references/prompts.md`](./references/prompts.md)：\n\n- **Prompt 1** — 内容提炼与风格设计：读懂材料、生成 4 套风格预览\n- **Prompt 2** — 图片版 PPT 生成：按选定风格逐页绘制并合并\n- **Prompt 3** — 可编辑 PPTX 还原：「复杂视觉保真 + 主要文字可编辑」混合策略\n\n## FAQ\n\n**必须用 Codex 吗？**\n不是。Codex 是推荐环境（文档读取 + GPT-Image 2.0 + python-pptx 一条龙），但三段提示词在任何能读文档、能生图的 AI 里都能用。\n\n**必须用 GPT-Image 2.0 吗？**\n不是。GPT-Image 2.0 在文字渲染和跨页一致性上表现最好；其他图像模型也能生成，把提示词里的模型名换成你用的即可。\n\n**生成的 PPT 能直接编辑吗？**\n第 2 步产出的是图片版 PPT（每页一张图，不可编辑）；第 3 步会逐页还原成可编辑 PPTX，主要文字用 PPT 原生文本框重建。\n\n**一次能还原多少页？**\n建议每次 1-3 页。拆得太多，元素拆分效果会明显下降。\n\n**这个技能会联网或上传数据吗？**\n不会。纯提示词方法论，所有执行都在你的 AI 环境中完成。\n\n## Roadmap\n\n- 补充更多真实案例与效果图\n- 增加书籍结构图 / 时间轴 / 人物关系图的固定版式\n- 提供可直接运行的 python-pptx 合并脚本\n- 整理上架 ClawHub / 各平台 Skill 商店\n\n## License\n\n[MIT](./LICENSE) © 2026 风清云影（helloo1568）\n\nFile v0.1.0:_meta.json\n\n{\n  \"ownerId\": \"kn7bgvk5s9y94bxeha55khk45x8c20m4\",\n  \"slug\": \"image-ppt\",\n  \"version\": \"0.1.0\",\n  \"publishedAt\": 1786155828967\n}\n\nFile v0.1.0:references/prompts.md\n\n# 三段核心提示词\n\n以下提示词提取自小黑盒社区教程《青年大学习AI版：零基础用GPT5.6做精美可编辑PPT》（作者：玩家22186848），参考 B 站 UP 主「一往无前河井」的学术 PPT 制作流程。\n\n---\n\n## Prompt 1: 内容提炼与风格设计\n\n用于让 AI 读懂书籍/文字材料，提炼核心内容，并生成四套不同风格的 PPT 缩略预览图。\n\n```\n请基于我上传的书籍PDF（或文字资料）与参考PPT样式图片，制作一份用于课堂汇报的图书介绍PPT，要求如下：\n\n请深入阅读并理解书籍PDF中的核心内容，提炼作者背景、写作背景、全书结构、主要观点、重点章节、典型案例、经典语句、现实意义与阅读启示，形成一套逻辑完整、重点清晰的汇报内容。\n\nPPT整体风格需要模仿我提供的参考PPT图片，保持相近的配色、字体、版式、素材风格和视觉元素，要求专业、美观、清新，适合正式课堂汇报展示。\n\n请避免大段文字堆砌，每页突出一个核心观点，重点展示书中的核心内容、重要结论和最值得分享的思想。可以加入书籍结构图、章节关系图、时间轴、人物关系图、流程图、重点总结页等可视化内容，并搭配与书籍主题相关的图片和素材。\n\n在生成最终PPT文件前，请先使用最新的image2图像生成模型，生成四套不同风格的PPT缩略预览图，采用类似幻灯片浏览视图的布局。四套方案的内容结构保持一致，但主题颜色、排版方式和视觉风格需要有所区别，同时都要符合课堂汇报专业、美观、简洁的要求。\n\n生成四套预览方案后先暂停，等待我选定其中一套风格，再根据选定方案制作完整的最终PPT文件。\n```\n\n**使用要点：**\n- 需同时提供：源材料（PDF/文字）+ 参考PPT风格图片\n- 生成四套预览后暂停，等待用户选择\n- \"image2图像生成模型\"在非 GPT 环境中替换为实际使用的生图工具\n\n---\n\n## Prompt 2: 生成完整图片版PPT\n\n用于在用户选定风格后，逐页生成完整的 PPT 页面图片并合并为 .pptx 文件。\n\n```\n选择第二套风格模板输出，注意是image2图像生成图片，随后将页面图像文件拼合成完整PowerPoint，并输出可下载的 pptx文件。\n```\n\n如果 AI 未能一次性输出 pptx 下载链接（通常因为单次对话只能调用一次工具），追加指令：\n\n```\n给我提供可以下载的.pptx下载包。\n```\n\n**使用要点：**\n- \"第二套\"替换为用户实际选定的风格编号\n- \"image2图像生成图片\"在非 GPT 环境中替换为实际使用的生图工具\n- 多页 PPT 可能需要分多轮生成，每轮生成一页\n- 最终需将所有页面图片合并为 .pptx 文件\n\n---\n\n## Prompt 3: 图片PPT还原为可编辑PPTX\n\n用于将图片版 PPT（每页是一整张图片）逐页还原为可编辑的 PPTX 文件。采用\"复杂视觉保真 + 主要文字可编辑\"的混合还原策略。\n\n```\n请把这个PPT的第一页还原成16:9的可编辑PPTX文件。\n\n【核心目标】\n采用\"复杂视觉保真 + 主要文字可编辑\"的混合还原策略。\n优先保留原图的整体设计质感、构图、视觉完成度和高级感，同时保证主要文字可以在PPT中直接编辑。\n不要将整页简单铺成一张背景图。\n\n【还原原则】\n先识别页面结构，将页面内容拆分为：\n1. 复杂视觉资产层\n2. 可编辑信息层\n\n复杂视觉资产层可优先从原图中裁切或提取为高清图片，并嵌入PPT，包括：\n- 品牌Logo、商标、产品UI、人物、商品图、官方图标；\n- 照片、插画、3D图、复杂背景、纹理、光影、玻璃拟态、金属质感；\n- 复杂图表、复杂流程图、循环图、拼图等高复杂度视觉区域。\n\n可编辑信息层尽量使用PPT原生元素重新搭建，包括：\n- 主标题、副标题、正文段落；\n- 金句、关键数字、关键词；\n- 结论框文字、注释文字、页脚说明、章节名和页码；\n- 简单线条、分隔线、基础几何图形、轻量标签、按钮、色块、基础表格和简单图表。\n\n主要文字必须尽量使用PPT原生文本框重新制作，不得为了视觉保真而将所有文字压缩成图片。\n\n复杂视觉区域中的小字，如果单独拆分会明显破坏画面质感，可以保留为图片，但需要在最终说明中明确标注。\n\n【文字处理要求】\n可编辑文字应尽量匹配原图的字体气质、字号层级、字重、颜色、行距、字距、对齐方式和具体位置。\n\n如果无法准确识别原图字体，请选择最接近原图风格的系统字体：\n- 中文：黑体、思源黑体、微软雅黑等；\n- 英文及数字：选择接近原图的无衬线字体或衬线字体。\n\n如果需要将原图中的文字改为可编辑文本，应先使用背景色、渐变近似或局部遮罩覆盖原文字，再叠加新的可编辑文本，避免出现文字重影。\n\n不得出现明显错字、漏字、换行错误、文本溢出、文字重叠或位置漂移。\n\n【设计还原要求】\n保持原图的版式比例、视觉重心、阅读顺序和留白节奏。\n\n保持原图的颜色、对比度、明暗关系、光源方向、阴影强度和空间层次。\n\n复杂视觉区域应保留原始质感，不要替换成低质感的PPT默认图形、默认图标、默认阴影或模板化卡片。\n\n所有元素的位置、大小、层级、裁切方式、圆角、描边、阴影、透明度和对齐关系都应尽量贴近原图。\n\n图表数据如果无法准确反推，可以按照原图的视觉比例进行近似重建，并在最终说明中标注\"数据为视觉近似\"。\n\n【输出要求】\n1. 输出一份16:9比例的可编辑PPTX文件；\n2. 同时渲染该页PPT的预览图，并与原始图片进行视觉对照；\n3. 如果预览图与原图在质感、比例、间距、颜色、层级或整体观感方面存在明显差距，应继续迭代修改，不能在第一次生成后直接结束；\n4. 确保文件可以在Microsoft PowerPoint中正常打开和继续编辑。\n\n完成后请简要说明：\n- 哪些元素被还原为可编辑文本、形状或图表；\n- 哪些元素是从原图裁切或嵌入的高清图片；\n- 哪些文字因为位于复杂视觉区域而保留为图片；\n- 是否存在字体替代或图表数据近似的情况。\n\n请先只完成第一页并输出文件，不要一次性处理整套PPT。待我确认第一页的还原质量和技术路线后，再使用相同标准逐页还原后续页面。\n```\n\n**使用要点：**\n- 每次只处理一页，最多不超过三页，否则拆分效果不理想\n- \"第一页\"替换为实际需要处理的页码\n- 该提示词同样适用于机制图、通路图等复杂图表的元素拆分\n- 核心策略：复杂视觉保留为图片 + 主要文字转为原生文本框\n\nFile v0.1.0:README.en.md\n\n# Image PPT Skill · Turn Text into Editable PPTs\n\n![GitHub stars](https://img.shields.io/github/stars/helloo1568/image-ppt?style=flat-square)\n![License](https://img.shields.io/github/license/helloo1568/image-ppt?style=flat-square)\n![Skill](https://img.shields.io/badge/Skill-Agent-111111?style=flat-square)\n![Codex](https://img.shields.io/badge/Codex-Recommended-222222?style=flat-square)\n![GPT-Image 2.0](https://img.shields.io/badge/GPT--Image%202.0-Recommended-0A7CFF?style=flat-square)\n\n> 🌏 **中文版: [README.md](./README.md)**\n\nAn agent skill for **Codex / Claude Code and other agent environments** that turns books, PDFs, or any text material into **beautiful, editable PPTX decks** — not a pile of static images you cannot touch.\n\n**Recommended environment: Codex + GPT-Image 2.0.** Codex reads the document, orchestrates the pipeline, and assembles files; GPT-Image 2.0 renders PPT pages with consistent style and pixel-accurate text.\n\n## Why Codex + GPT-Image 2.0\n\n| Stage | Recommended | Why |\n|-------|-------------|-----|\n| Document understanding & orchestration | **Codex** | Shell access to read long docs, loop image generation, and auto-assemble/restore PPTX in one run |\n| Page rendering | **GPT-Image 2.0** | Pixel-accurate text, cross-page style consistency, commercial-grade layout |\n| PPTX assembly | Codex + python-pptx | Embeds image pages in 16:9 order and outputs a downloadable .pptx |\n\n> Works in any AI assistant with document reading, image generation, and file output capabilities (GPT, Claude, Kimi, Doubao, WorkBuddy, etc.) — follow the adaptation notes in the prompts.\n\n## Three-Step Workflow\n\n```\nSource material (PDF / book / text)\n    │\n    ▼\n① Extract content + design styles   Read the material, build an outline, generate 4 style previews\n    │\n    ▼\n② Generate image-based PPT          Render pages in the chosen style, merge into a downloadable .pptx\n    │\n    ▼\n③ Restore an editable PPTX          Rebuild page by page (\"visual fidelity + editable text\")\n```\n\n## 30-Second Start\n\nSend this to an agent with shell access (Codex recommended):\n\n```text\nInstall the image-ppt skill for me. Clone https://github.com/helloo1568/image-ppt into the local\nskills directory, then verify SKILL.md and references/ exist. After that, \"turn this book into a PPT\"\nwill trigger it.\n```\n\nThen just say:\n\n```text\nTurn this PDF into a class-presentation PPT. Generate 4 style previews first; I'll pick one before you continue.\n```\n\nMore example requests:\n\n```text\nTurn this book into a book-sharing deck; generate images with GPT-Image 2.0.\nMake a lab-meeting PPT from this report, following the template style I uploaded.\nImage PPT: convert this Markdown into an editable 16:9 PPTX.\n```\n\n## Highlights\n\n- 🧠 **Reads the material**: extracts author background, structure, key ideas, examples, quotes, and takeaways\n- 🎨 **Four style previews**: 4 previews with different colors/layouts/visual styles — pick one before rendering\n- 🖼 **Page-by-page rendering**: one core idea per page, with structure diagrams, timelines, and relationship maps\n- 📦 **Editable PPTX**: complex visuals kept as hi-res images, main text rebuilt as native PPT text boxes\n- 🔁 **Iterative restore**: 1-3 pages per pass; confirm one page's quality before batch-processing the rest\n\n## Good Fit / Not a Fit\n\n**✅ Good fit**: classroom group presentations / book sharing / lab paper reviews / project reports / pitch events / coursework\n\n**❌ Not a fit**: real-time multi-user collaborative editing (use Office online instead), dense data-table reports (image-based pages have limited information density)\n\n## Common Use Cases\n\n| Task | Recommended Approach |\n|------|----------------------|\n| Book → book-sharing deck | Full three-step flow, emphasize key ideas and quotes |\n| Paper / literature → lab meeting | Prompt 1 to structure, add flow/relationship diagrams |\n| Coursework / classroom demo | Reference template + 4 style previews for a quick final |\n| Pitch / project report | Highlight conclusions and key-result pages, keep it tight |\n| Existing image deck needs text edits | Prompt 3 to restore pages into an editable PPTX |\n\n## Platform Support\n\n| Platform | Status | Notes |\n|----------|--------|-------|\n| **Codex** | Recommended | Full pipeline: read docs, GPT-Image 2.0 rendering, python-pptx assembly/restore |\n| Claude Code | Works | Strong text/orchestration; image gen needs an external tool |\n| GPT / ChatGPT | Works | Native image capability; just paste the three prompts |\n| WorkBuddy | Works | Document reading + local toolchain per adaptation notes |\n| Kimi / Doubao / Tongyi | Partial | Confirm their image-generation and file-output capabilities |\n\n## Installation\n\n### One-liner (recommended)\n\n```bash\nnpx skills add https://github.com/helloo1568/image-ppt --skill image-ppt\n```\n\n### Let the agent install it\n\n> Install the `image-ppt` skill for me:\n>\n> 1. Make sure the local skills directory exists (`~/.claude/skills/` or `~/.codex/skills/`)\n> 2. Run `git clone https://github.com/helloo1568/image-ppt.git <skills-dir>/image-ppt`\n> 3. Verify `SKILL.md` and `references/prompts.md` exist\n> 4. Tell me when done; \"make a PPT\" will trigger it afterwards\n\n### Manual clone\n\n```bash\ngit clone https://github.com/helloo1568/image-ppt.git ~/.claude/skills/image-ppt\n# or into the Codex skills directory\ngit clone https://github.com/helloo1568/image-ppt.git ~/.codex/skills/image-ppt\n```\n\n### Trigger phrases\n\n- \"Turn this book into a PPT\"\n- \"Make a class-presentation PPT from this PDF\"\n- \"Image PPT, generate a book-sharing deck\"\n- \"Make an editable PPTX from this material\"\n- \"image-ppt\"\n\n## Workflow\n\nThe skill is a structured workflow the agent walks through:\n\n1. **Read the material** — extract author background, structure, key ideas, examples, quotes, takeaways\n2. **Design styles** — ask about a reference template, generate 4 style previews with GPT-Image 2.0\n3. **User picks** — show previews, wait for a style choice\n4. **Render pages** — cover → agenda → content → summary → thanks, in the chosen style\n5. **Merge PPTX** — embed image pages in 16:9 order, output a downloadable .pptx\n6. **Restore editability** — rebuild 1-3 pages per pass: complex visuals as images, main text as native text boxes\n7. **Compare & iterate** — render a preview against the original; keep iterating on obvious gaps\n8. **Delivery notes** — report what is editable text vs. image, and any font substitutions\n\nDetails in [`SKILL.md`](./SKILL.md); the three core prompts live in [`references/prompts.md`](./references/prompts.md).\n\n## Repo Layout\n\n```\nimage-ppt/\n├── SKILL.md              ← Main skill file: three-step workflow & adaptation notes\n├── README.md             ← Chinese README\n├── README.en.md          ← This file (English)\n├── manifest.yaml         ← Skill manifest (version, triggers, security notes)\n└── references/\n    └── prompts.md        ← Three copy-paste-ready core prompts\n```\n\n## Core Prompts\n\n- **Prompt 1** — Content extraction & style design: read the material, generate 4 style previews\n- **Prompt 2** — Image-based PPT generation: render pages in the chosen style and merge\n- **Prompt 3** — Editable PPTX restore: \"visual fidelity + editable text\" hybrid strategy\n\n## FAQ\n\n**Do I have to use Codex?**\nNo. Codex is the recommended environment (document reading + GPT-Image 2.0 + python-pptx in one flow), but the three prompts work in any AI that can read documents and generate images.\n\n**Do I have to use GPT-Image 2.0?**\nNo. It offers the best text rendering and cross-page consistency; swap the model name in the prompts for whatever you use.\n\n**Is the generated PPT directly editable?**\nStep 2 produces an image-based PPT (one image per page, not editable). Step 3 restores pages into an editable PPTX with main text as native text boxes.\n\n**How many pages per restore pass?**\n1-3 pages at a time. Too many at once degrades the element-splitting quality.\n\n**Does this skill go online or upload data?**\nNo. It is a pure prompt methodology — everything runs in your own AI environment.\n\n## Roadmap\n\n- More real-world examples and preview images\n- Fixed layouts for structure diagrams / timelines / relationship maps\n- A ready-to-run python-pptx merge script\n- Listing on ClawHub and other skill marketplaces\n\n## License\n\n[MIT](./LICENSE) © 2026 风清云影 (helloo1568)\n\nFile v0.1.0:skill-card.md\n\n## Description:\n\nImage PPT helps agents turn books, PDFs, and other text materials into editable PowerPoint decks through content extraction, visual slide generation, and editable PPTX reconstruction.\n\nThis skill is ready for commercial/non-commercial use.\n\n## Publisher:\n\n[helloo1568](https://clawhub.ai/user/helloo1568)\n\n### License/Terms of Use:\n\nMIT\n\n## Use Case:\n\nExternal users, developers, educators, and presenters use this skill to convert source documents or text into presentation decks, preview visual styles, generate image-based slides, and reconstruct editable PPTX files.\n\n### Deployment Geography for Use:\n\nGlobal\n\n## Known Risks and Mitigations:\n\nRisk: Source documents may be sent to external AI or image-generation services during normal use.\n\nMitigation: Use the skill only with documents the user is allowed to process in the selected AI environment, and confirm data-handling requirements before uploading sensitive material.\n\nRisk: The README recommends unpinned remote installation commands.\n\nMitigation: Review the skill before installing and prefer a pinned, trusted installation path.\n\n## Reference(s):\n\n- [ClawHub skill page](https://clawhub.ai/helloo1568/skills/image-ppt)\n- [Server-resolved GitHub source](https://github.com/helloo1568/image-ppt)\n- [Core prompts](references/prompts.md)\n- [English README](README.en.md)\n\n## Skill Output:\n\n**Output Type(s):** [Text, Markdown, Code, Shell commands, Configuration, Guidance, Files]\n\n**Output Format:** [Markdown workflow guidance with prompt templates, optional shell or Python commands, generated slide images, and PPTX files]\n\n**Output Parameters:** [1D]\n\n**Other Properties Related to Output:** [Can produce an image-based PPTX first and an editable PPTX after page-by-page reconstruction; output quality depends on the selected image model and source document permissions.]\n\n## Skill Version(s):\n\n0.1.0 (source: ClawHub release metadata)\n\n## Ethical Considerations:\n\nUsers should evaluate whether this skill is appropriate for their environment, review any generated or modified files before relying on them, and apply their organization's safety, security, and compliance requirements before deployment.\n\nFile v0.1.0:manifest.yaml\n\n# 图片PPT (image-ppt) 技能清单 — 通用方法论 / Generic Skill Manifest\n\nname: image-ppt\ndisplay_name: 图片PPT\nversion: 1.0.0\ndescription: >-\n  将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能（图片PPT）。\n  三步流程：内容提炼与风格设计 → 图片版PPT生成 → 可编辑PPTX还原。\n  推荐运行环境：Codex + GPT-Image 2.0（Codex 编排流程、GPT-Image 2.0 绘制页面）。\n  平台无关，也可在任何具备文档读取、图像生成与文件输出能力的 AI 助手中使用。\n  A platform-agnostic workflow to turn books/PDFs/text into beautiful, editable PPT decks.\n  Recommended: Codex + GPT-Image 2.0.\n  适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。\nauthor: 风清云影 (helloo1568)\nlicense: MIT\ncategory: content\ntriggers:\n  - 图片PPT\n  - 做PPT\n  - 生成PPT\n  - 把书做成PPT\n  - 读书分享PPT\n  - 课堂汇报PPT\n  - image-ppt\n  - doc-to-editable-ppt\nrequires_api_keys: false\nplatforms:\n  - Codex (recommended, with GPT-Image 2.0)\n  - ChatGPT/GPT, Claude, Kimi, Doubao, WorkBuddy, Tongyi, etc.\nsecurity_notes: >-\n  纯提示词型方法论，不含任何脚本、可执行代码或网络请求，\n  无密钥、无数据外传、无越权系统操作。安全等级 P2（安全）。\nfiles:\n  - SKILL.md\n  - README.md\n  - README.en.md\n  - references/prompts.md\n\nFile v0.1.0:LICENSE\n\nMIT License\n\nCopyright (c) 2026 风清云影\n\nPermission is hereby granted, free of charge, to any person obtaining a copy\nof this software and associated documentation files (the \"Software\"), to deal\nin the Software without restriction, including without limitation the rights\nto use, copy, modify, merge, publish, distribute, sublicense, and/or sell\ncopies of the Software, and to permit persons to whom the Software is\nfurnished to do so, subject to the following conditions:\n\nThe above copyright notice and this permission notice shall be included in all\ncopies or substantial portions of the Software.\n\nTHE SOFTWARE IS PROVIDED \"AS IS\", WITHOUT WARRANTY OF ANY KIND, EXPRESS OR\nIMPLIED, INCLUDING BUT NOT LIMITED TO THE WARRANTIES OF MERCHANTABILITY,\nFITNESS FOR A PARTICULAR PURPOSE AND NONINFRINGEMENT. IN NO EVENT SHALL THE\nAUTHORS OR COPYRIGHT HOLDERS BE LIABLE FOR ANY CLAIM, DAMAGES OR OTHER\nLIABILITY, WHETHER IN AN ACTION OF CONTRACT, TORT OR OTHERWISE, ARISING FROM,\nOUT OF OR IN CONNECTION WITH THE SOFTWARE OR THE USE OR OTHER DEALINGS IN THE\nSOFTWARE.","readmeExcerpt":"Skill: image-ppt Owner: helloo1568 Summary: 图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。 Tags: latest:0.1.0 Version history: v0.1.0 | 2026-08-08T02:23:48.967Z | auto Initial release of image-ppt skill. - Pr","codeSnippets":[],"executableExamples":[{"language":"text","snippet":"用户输入文字材料（PDF / 书籍 / 论文 / 报告 / 纯文本）\n         │\n         ▼\n  ┌──────────────┐\n  │ Step 1       │  内容提炼 + 风格设计\n  │ 读懂材料      │  → 提炼核心内容\n  │ 生成4套预览   │  → 生成4套风格预览图\n  └──────┬───────┘\n         │ 用户选定一套风格\n         ▼\n  ┌──────────────┐\n  │ Step 2       │  图片版PPT生成\n  │ 逐页生成图片  │  → 按选定风格逐页生成\n  │ 合并为PPTX    │  → 合并为可下载 .pptx\n  └──────┬───────┘\n         │ 得到图片版PPT（不可编辑）\n         ▼\n  ┌──────────────┐\n  │ Step 3       │  可编辑化还原\n  │ 逐页拆解还原  │  → 图片层 + 可编辑文字层\n  │ 输出可编辑PPTX│  → 输出可编辑 .pptx\n  └──────────────┘"},{"language":"text","snippet":"源材料（PDF / 书籍 / 文字）\n    │\n    ▼\n① 内容提炼 + 风格设计   读懂材料、提炼大纲，生成 4 套风格预览供选择\n    │\n    ▼\n② 图片版 PPT 生成       按选定风格逐页绘制，合并为可下载 .pptx\n    │\n    ▼\n③ 可编辑 PPTX 还原      逐页拆解为「复杂视觉保真 + 文字可编辑」的 PPTX"},{"language":"text","snippet":"帮我安装 image-ppt 技能。请把 https://github.com/helloo1568/image-ppt 克隆到本地技能目录，\n安装完成后检查 SKILL.md、references/ 是否存在。装好后我说\"帮我把这本书做成 PPT\"就会触发它。"},{"language":"text","snippet":"帮我把这份 PDF 做成课堂汇报 PPT，先按提示词生成 4 套风格预览，我选一套再继续。"},{"language":"text","snippet":"帮我把这本书做成读书分享 PPT，配图用 GPT-Image 2.0 生成。\n把这份报告做成组会汇报 PPT，参考我上传的模板风格。\n图片PPT：把这份 Markdown 变成 16:9 可编辑 PPTX。"},{"language":"bash","snippet":"npx skills add https://github.com/helloo1568/image-ppt --skill image-ppt"}],"parameters":null,"dependencies":[],"permissions":[],"extractedFiles":[{"path":"SKILL.md","content":"---\nname: image-ppt\ndescription: \"图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。\"\nagent_created: true\n---\n\n# 图片PPT — 文字材料转可编辑PPT工作流（通用方法论）\n\n## Overview\n\n本技能提供一套完整的三步工作流，将书籍 PDF、论文、报告等文字材料转化为精美且可编辑的 PowerPoint 演示文稿。工作流源自小黑盒社区教程（作者：玩家22186848），参考 B 站 UP 主「一往无前河井」的学术 PPT 制作思路，经泛化后适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等多种场景。\n\n**推荐运行环境：Codex + GPT-Image 2.0。** Codex 负责文档读取、流程编排与 PPTX 拼装/还原（shell + python-pptx 一条龙）；GPT-Image 2.0 负责绘制风格统一、文字精准的 PPT 页面。Step 1/2 的提示词中\"image2图像生成模型\"在 Codex 环境对应 **GPT-Image 2.0**，在 GPT/ChatGPT 环境对应其原生图像模型，在其他环境替换为实际使用的生图工具。\n\n**平台无关**：这套方法论的核心是三段提示词 + 三步流程，可在任何具备「文档读取、图像生成、文件输出」能力的 AI 助手中使用（Codex、ChatGPT/GPT、Claude、Kimi、豆包、WorkBuddy、通义等）。执行时仅需将文中标注的通用能力映射到你当前使用的 AI 工具即可。\n\n三段核心提示词存放于 `references/prompts.md`，按步骤引用。\n\n## Workflow Decision Tree\n\n```\n用户输入文字材料（PDF / 书籍 / 论文 / 报告 / 纯文本）\n         │\n         ▼\n  ┌──────────────┐\n  │ Step 1       │  内容提炼 + 风格设计\n  │ 读懂材料      │  → 提炼核心内容\n  │ 生成4套预览   │  → 生成4套风格预览图\n  └──────┬───────┘\n         │ 用户选定一套风格\n         ▼\n  ┌──────────────┐\n  │ Step 2       │  图片版PPT生成\n  │ 逐页生成图片  │  → 按选定风格逐页生成\n  │ 合并为PPTX    │  → 合并为可下载 .pptx\n  └──────┬───────┘\n         │ 得到图片版PPT（不可编辑）\n         ▼\n  ┌──────────────┐\n  │ Step 3       │  可编辑化还原\n  │ 逐页拆解还原  │  → 图片层 + 可编辑文字层\n  │ 输出可编辑PPTX│  → 输出可编辑 .pptx\n  └──────────────┘\n```\n\n## Step 1: 内容提炼与风格设计\n\n### 目标\n\n深入阅读并理解源材料，提炼核心内容；同时生成四套不同风格的 PPT 缩略预览图供用户选择。\n\n### 执行步骤\n\n1. **读取源材料**：读取用户提供的 PDF/文档。长文档分段读取并汇总要点。\n2. **提炼内容大纲**：从材料中提取以下要素：\n   - 作者背景、写作背景\n   - 全书/全文结构\n   - 主要观点、重点章节\n   - 典型案例、经典语句\n   - 现实意义与阅读启示\n3. **获取参考风格**：询问用户是否有参考 PPT 模板图片。如有，分析该图片的配色、字体、版式风格。\n4. **生成四套风格预览**：使用 AI 的图像生成能力，按 `references/prompts.md` 中的 **Prompt 1** 生成四套不同风格的 PPT 缩略预览图（类似幻灯片浏览视图布局）。四套方案内容结构一致，但主题颜色、排版方式和视觉风格需有区别。\n5. **暂停等待用户选择**：展示四套预览图，请用户选定其中一套风格。\n\n### 适配说明\n\n- **Codex（推荐）**：用文档读取能力提炼内容，再调用图像生成（推荐 GPT-Image 2.0）生成预览图。Prompt 1 中的\"image2图像生成模型\"对应 GPT-Image 2.0。\n- **具备原生图像生成能力的 AI（如 GPT）**：直接将源材料 PDF + 参考风格图片 + Prompt 1 一起发送，AI 会调用其图像模型生成预览。\n- **通过外部工具生图的 AI（如 Claude、WorkBuddy）**：先用文档读取能力提炼内容，再调用可用的生图工具生成预览图。Prompt 1 中的\"image2图像生成模型\"替换为实际使用的生图工具。\n\n## Step 2: 生成完整图片版PPT\n\n### 目标\n\n根据用户选定的风格模板，逐页生成完整的 PPT 页面图片，并合并为可下载的 .pptx 文件。\n\n### 执行步骤\n\n1. **确认风格选择**：记录用户在 Step 1 中选定的风格编号。\n2. **逐页生成图片**：基于选定的风格模板和 Step 1 提炼的内容大纲，逐页生成 PPT 页面图片。每页突出一个核心观点，避免大段文字堆砌。\n3. **合并为 PPTX**：将所有页面图片按顺序嵌入 16:9 幻灯片，生成 .pptx 文件（可借助 PPT 生成器、python-pptx 脚本或 AI 自带的文件输出能力）。\n4. **交付文件**：将生成的 .pptx 文件交付给用户。\n\n### 适配说明\n\n- **Codex（推荐）**：循环调用图像生成（推荐 GPT-Image 2.0）逐页绘制，再用 python-pptx 脚本合并为 .pptx。Prompt 2 中的\"image2图像生成图片\"对应 GPT-Image 2.0。\n- **具备原生图像生成能力的 AI（如 GPT）**：发送 Prompt 2（见 `references/prompts.md`），AI 会逐页生成并自动合并为 pptx。\n- **通过外部工具生图的 AI**：手动编排——先循环调用生图工具生成每页图片，再用 PPT 生成器或 python-pptx 脚本合并。注意部分 AI 单次对话只能调用一次工具，需分多轮完成所有页面生成。\n\n### 注意事项\n\n- 单次生图调用通常只能生成一张图片，多页 PPT 需要循环调用。\n- 生成顺序建议：封面 → 目录 → 各内容页 → 总结页 → 致谢页。\n- 每页生成时需在 prompt 中包含：选定风格描述 "},{"path":"README.md","content":"# 图片PPT Skill · 文字材料转可编辑PPT\n\n![GitHub stars](https://img.shields.io/github/stars/helloo1568/image-ppt?style=flat-square)\n![License](https://img.shields.io/github/license/helloo1568/image-ppt?style=flat-square)\n![Skill](https://img.shields.io/badge/Skill-Agent-111111?style=flat-square)\n![Codex](https://img.shields.io/badge/Codex-Recommended-222222?style=flat-square)\n![GPT-Image 2.0](https://img.shields.io/badge/GPT--Image%202.0-Recommended-0A7CFF?style=flat-square)\n\n> 🌏 **English version: [README.en.md](./README.en.md)**\n\n一个适配 **Codex / Claude Code 等 Agent 环境**的 PPT 生成技能：把书籍、PDF 或任意文字材料，变成**精美且可编辑的 PPTX**，而不是一张张没法改的图片。\n\n**推荐运行环境：Codex + GPT-Image 2.0**。Codex 负责读懂文档、编排流程、拼装文件；GPT-Image 2.0 负责绘制风格统一、文字精准的 PPT 页面。\n\n## 为什么推荐 Codex + GPT-Image 2.0\n\n| 环节 | 推荐工具 | 为什么 |\n|------|---------|--------|\n| 文档理解与流程编排 | **Codex** | 有 shell 权限，能读长文档、循环生图、自动合并/还原 PPTX，一次跑完三步流程 |\n| 页面绘制 | **GPT-Image 2.0** | 像素级文字渲染、跨页风格一致、商业级排版，能精确还原模板气质 |\n| PPTX 拼装 | Codex + python-pptx | 图片页按 16:9 顺序嵌入，输出可下载 .pptx |\n\n> 本技能也兼容其他具备「文档读取 + 图像生成 + 文件输出」能力的 AI 助手（GPT、Claude、Kimi、豆包、WorkBuddy 等），按提示词中的适配说明取用即可。\n\n## 三步工作流\n\n```\n源材料（PDF / 书籍 / 文字）\n    │\n    ▼\n① 内容提炼 + 风格设计   读懂材料、提炼大纲，生成 4 套风格预览供选择\n    │\n    ▼\n② 图片版 PPT 生成       按选定风格逐页绘制，合并为可下载 .pptx\n    │\n    ▼\n③ 可编辑 PPTX 还原      逐页拆解为「复杂视觉保真 + 文字可编辑」的 PPTX\n```\n\n## 30 秒开始\n\n直接把这段话发给有 shell 权限的 AI Agent（推荐 Codex）：\n\n```text\n帮我安装 image-ppt 技能。请把 https://github.com/helloo1568/image-ppt 克隆到本地技能目录，\n安装完成后检查 SKILL.md、references/ 是否存在。装好后我说\"帮我把这本书做成 PPT\"就会触发它。\n```\n\n安装后直接对 Agent 说：\n\n```text\n帮我把这份 PDF 做成课堂汇报 PPT，先按提示词生成 4 套风格预览，我选一套再继续。\n```\n\n也可以试这些请求：\n\n```text\n帮我把这本书做成读书分享 PPT，配图用 GPT-Image 2.0 生成。\n把这份报告做成组会汇报 PPT，参考我上传的模板风格。\n图片PPT：把这份 Markdown 变成 16:9 可编辑 PPTX。\n```\n\n## 效果\n\n- 🧠 **读懂材料**：自动提炼作者背景、全书结构、主要观点、典型案例、经典语句与现实意义\n- 🎨 **四套风格预览**：生成 4 套不同配色/排版/视觉风格的缩略图，选定后再开工\n- 🖼 **逐页绘制**：每页突出一个核心观点，配结构图、时间轴、人物关系图等可视化\n- 📦 **可编辑 PPTX**：复杂视觉保留为高清图片，主要文字还原为 PPT 原生文本框\n- 🔁 **逐页迭代**：每次还原 1-3 页，先确认一页质量再批量推进\n\n## 适合 / 不适合\n\n**✅ 合适**：大学课堂小组汇报 / 读书分享 / 组会文献汇报 / 项目汇报 / 比赛路演 / 课程作业\n\n**❌ 不合适**：需要多人实时协作编辑的文档（建议直接用 Office 在线协作）、大段表格数据型汇报（图片版信息密度有限）\n\n## 常见使用场景\n\n| 任务 | 推荐方式 |\n|------|---------|\n| 一本书变成读书分享 PPT | 三步全流程，重点提炼核心观点与金句 |\n| 论文 / 文献做组会汇报 | 用 Prompt 1 提炼结构，配流程图、关系图 |\n| 课程作业 / 课堂展示 | 参考模板图 + 四套风格预览，快速定稿 |\n| 比赛路演 / 项目汇报 | 突出结论与亮点页，控制页数与节奏 |\n| 已有图片版 PPT 要改文字 | 直接用 Prompt 3 逐页还原为可编辑 PPTX |\n\n## 平台支持\n\n| 平台 | 状态 | 说明 |\n|------|------|------|\n| **Codex** | 推荐 | 完整跑通三步流程：读文档、GPT-Image 2.0 生图、python-pptx 拼装/还原 |\n| Claude Code | 可用 | 文本/编排能力强；生图需接入外部图像工具 |\n| GPT / ChatGPT | 可用 | 原生图像能力，直接粘贴三段提示词即可 |\n| WorkBuddy | 可用 | 支持文档读取与本地工具链，按适配说明执行 |\n| Kimi / 豆包 / 通义 | 部分可用 | 需自行确认其图像生成与文件输出能力 |\n\n## 安装\n\n### 方式一：一行命令安装（推荐）\n\n```bash\nnpx skills add https://github.com/helloo1568/image-ppt --skill image-ppt\n```\n\n### 方式二：发给 AI 自动安装\n\n> 帮我安装 `image-ppt` 这个 skill。按下面步骤做：\n>\n> 1. 确保本地技能目录存在（`~/.claude/skills/` 或 `~/.codex/skills/`，不存在就创建）\n> 2. 执行 `git clone https://github.com/helloo1568/image-ppt.git <技能目录>/image-ppt`\n> 3. 验证 `SKILL.md`、`references/prompts.md` 存在\n> 4. 告诉我安装好了，之后我说\"做一份 PPT\"之类的话就会触"},{"path":"_meta.json","content":"{\n  \"ownerId\": \"kn7bgvk5s9y94bxeha55khk45x8c20m4\",\n  \"slug\": \"image-ppt\",\n  \"version\": \"0.1.0\",\n  \"publishedAt\": 1786155828967\n}"},{"path":"references/prompts.md","content":"# 三段核心提示词\n\n以下提示词提取自小黑盒社区教程《青年大学习AI版：零基础用GPT5.6做精美可编辑PPT》（作者：玩家22186848），参考 B 站 UP 主「一往无前河井」的学术 PPT 制作流程。\n\n---\n\n## Prompt 1: 内容提炼与风格设计\n\n用于让 AI 读懂书籍/文字材料，提炼核心内容，并生成四套不同风格的 PPT 缩略预览图。\n\n```\n请基于我上传的书籍PDF（或文字资料）与参考PPT样式图片，制作一份用于课堂汇报的图书介绍PPT，要求如下：\n\n请深入阅读并理解书籍PDF中的核心内容，提炼作者背景、写作背景、全书结构、主要观点、重点章节、典型案例、经典语句、现实意义与阅读启示，形成一套逻辑完整、重点清晰的汇报内容。\n\nPPT整体风格需要模仿我提供的参考PPT图片，保持相近的配色、字体、版式、素材风格和视觉元素，要求专业、美观、清新，适合正式课堂汇报展示。\n\n请避免大段文字堆砌，每页突出一个核心观点，重点展示书中的核心内容、重要结论和最值得分享的思想。可以加入书籍结构图、章节关系图、时间轴、人物关系图、流程图、重点总结页等可视化内容，并搭配与书籍主题相关的图片和素材。\n\n在生成最终PPT文件前，请先使用最新的image2图像生成模型，生成四套不同风格的PPT缩略预览图，采用类似幻灯片浏览视图的布局。四套方案的内容结构保持一致，但主题颜色、排版方式和视觉风格需要有所区别，同时都要符合课堂汇报专业、美观、简洁的要求。\n\n生成四套预览方案后先暂停，等待我选定其中一套风格，再根据选定方案制作完整的最终PPT文件。\n```\n\n**使用要点：**\n- 需同时提供：源材料（PDF/文字）+ 参考PPT风格图片\n- 生成四套预览后暂停，等待用户选择\n- \"image2图像生成模型\"在非 GPT 环境中替换为实际使用的生图工具\n\n---\n\n## Prompt 2: 生成完整图片版PPT\n\n用于在用户选定风格后，逐页生成完整的 PPT 页面图片并合并为 .pptx 文件。\n\n```\n选择第二套风格模板输出，注意是image2图像生成图片，随后将页面图像文件拼合成完整PowerPoint，并输出可下载的 pptx文件。\n```\n\n如果 AI 未能一次性输出 pptx 下载链接（通常因为单次对话只能调用一次工具），追加指令：\n\n```\n给我提供可以下载的.pptx下载包。\n```\n\n**使用要点：**\n- \"第二套\"替换为用户实际选定的风格编号\n- \"image2图像生成图片\"在非 GPT 环境中替换为实际使用的生图工具\n- 多页 PPT 可能需要分多轮生成，每轮生成一页\n- 最终需将所有页面图片合并为 .pptx 文件\n\n---\n\n## Prompt 3: 图片PPT还原为可编辑PPTX\n\n用于将图片版 PPT（每页是一整张图片）逐页还原为可编辑的 PPTX 文件。采用\"复杂视觉保真 + 主要文字可编辑\"的混合还原策略。\n\n```\n请把这个PPT的第一页还原成16:9的可编辑PPTX文件。\n\n【核心目标】\n采用\"复杂视觉保真 + 主要文字可编辑\"的混合还原策略。\n优先保留原图的整体设计质感、构图、视觉完成度和高级感，同时保证主要文字可以在PPT中直接编辑。\n不要将整页简单铺成一张背景图。\n\n【还原原则】\n先识别页面结构，将页面内容拆分为：\n1. 复杂视觉资产层\n2. 可编辑信息层\n\n复杂视觉资产层可优先从原图中裁切或提取为高清图片，并嵌入PPT，包括：\n- 品牌Logo、商标、产品UI、人物、商品图、官方图标；\n- 照片、插画、3D图、复杂背景、纹理、光影、玻璃拟态、金属质感；\n- 复杂图表、复杂流程图、循环图、拼图等高复杂度视觉区域。\n\n可编辑信息层尽量使用PPT原生元素重新搭建，包括：\n- 主标题、副标题、正文段落；\n- 金句、关键数字、关键词；\n- 结论框文字、注释文字、页脚说明、章节名和页码；\n- 简单线条、分隔线、基础几何图形、轻量标签、按钮、色块、基础表格和简单图表。\n\n主要文字必须尽量使用PPT原生文本框重新制作，不得为了视觉保真而将所有文字压缩成图片。\n\n复杂视觉区域中的小字，如果单独拆分会明显破坏画面质感，可以保留为图片，但需要在最终说明中明确标注。\n\n【文字处理要求】\n可编辑文字应尽量匹配原图的字体气质、字号层级、字重、颜色、行距、字距、对齐方式和具体位置。\n\n如果无法准确识别原图字体，请选择最接近原图风格的系统字体：\n- 中文：黑体、思源黑体、微软雅黑等；\n- 英文及数字：选择接近原图的无衬线字体或衬线字体。\n\n如果需要将原图中的文字改为可编辑文本，应先使用背景色、渐变近似或局部遮罩覆盖原文字，再叠加新的可编辑文本，避免出现文字重影。\n\n不得出现明显错字、漏字、换行错误、文本溢出、文字重叠或位置漂移。\n\n【设计还原要求】\n保持原图的版式比例、视觉重心、阅读顺序和留白节奏。\n\n保持原图的颜色、对比度、明暗关系、光源方向、阴影强度和空间层次。\n\n复杂视觉区域应保留原始质感，不要替换成低质感的PPT默认图形、默认图标、默认阴影或模板化卡片。\n\n所有元素的位置、大小、层级、裁切方式、圆角、描边、阴影、透明度和对齐关系都应尽量贴近原图。\n\n图表数据如果无法准确反推，可以按照原图的视觉比例进行近似重建，并在最终说明中标注\"数据为视觉近似\"。\n\n【输出要求】\n1. 输出一份16:9比例的可编辑PPTX文件；\n2. 同时渲染该页PPT的预览图，并与原始图片进行视觉对照；\n3. 如果预览图与原图在质感、比例、间距、颜色、层级或整体观感方面存在明显差距，应继续迭代修改，不能在第一次生成后直接结束；\n4. 确保文件可以在Microsoft PowerPoint中正常打开和继续编辑。\n\n完成后请简要说明：\n- 哪些元素被还原为可编辑文本、形状或图表；\n- 哪些元素是从原图裁切或嵌入的高清图片；\n- 哪些文字因为位于复杂视觉区域而保留为图片；\n- 是否存在字体替代或图表数据近似的情况。\n\n请先只完成第一页并输出文件，不要一次性处理整套PPT。待我确认第一页的还原质量和技术路线后，再使用相同标准逐页还原后续页面。\n```\n\n**使用要点：**\n- 每次只处理一页，最多不超过三页，否则拆分效果不理想\n- \"第一页\"替换为实际需要处理的页码\n- 该提示词同样适用于机制图、通路图等复杂图表的元素拆分\n- 核心策略：复杂视觉保留为图片 + 主要文字转为原生文本框"},{"path":"README.en.md","content":"# Image PPT Skill · Turn Text into Editable PPTs\n\n![GitHub stars](https://img.shields.io/github/stars/helloo1568/image-ppt?style=flat-square)\n![License](https://img.shields.io/github/license/helloo1568/image-ppt?style=flat-square)\n![Skill](https://img.shields.io/badge/Skill-Agent-111111?style=flat-square)\n![Codex](https://img.shields.io/badge/Codex-Recommended-222222?style=flat-square)\n![GPT-Image 2.0](https://img.shields.io/badge/GPT--Image%202.0-Recommended-0A7CFF?style=flat-square)\n\n> 🌏 **中文版: [README.md](./README.md)**\n\nAn agent skill for **Codex / Claude Code and other agent environments** that turns books, PDFs, or any text material into **beautiful, editable PPTX decks** — not a pile of static images you cannot touch.\n\n**Recommended environment: Codex + GPT-Image 2.0.** Codex reads the document, orchestrates the pipeline, and assembles files; GPT-Image 2.0 renders PPT pages with consistent style and pixel-accurate text.\n\n## Why Codex + GPT-Image 2.0\n\n| Stage | Recommended | Why |\n|-------|-------------|-----|\n| Document understanding & orchestration | **Codex** | Shell access to read long docs, loop image generation, and auto-assemble/restore PPTX in one run |\n| Page rendering | **GPT-Image 2.0** | Pixel-accurate text, cross-page style consistency, commercial-grade layout |\n| PPTX assembly | Codex + python-pptx | Embeds image pages in 16:9 order and outputs a downloadable .pptx |\n\n> Works in any AI assistant with document reading, image generation, and file output capabilities (GPT, Claude, Kimi, Doubao, WorkBuddy, etc.) — follow the adaptation notes in the prompts.\n\n## Three-Step Workflow\n\n```\nSource material (PDF / book / text)\n    │\n    ▼\n① Extract content + design styles   Read the material, build an outline, generate 4 style previews\n    │\n    ▼\n② Generate image-based PPT          Render pages in the chosen style, merge into a downloadable .pptx\n    │\n    ▼\n③ Restore an editable PPTX          Rebuild page by page (\"visual fidelity + editable text\")\n```\n\n## 30-Second Start\n\nSend this to an agent with shell access (Codex recommended):\n\n```text\nInstall the image-ppt skill for me. Clone https://github.com/helloo1568/image-ppt into the local\nskills directory, then verify SKILL.md and references/ exist. After that, \"turn this book into a PPT\"\nwill trigger it.\n```\n\nThen just say:\n\n```text\nTurn this PDF into a class-presentation PPT. Generate 4 style previews first; I'll pick one before you continue.\n```\n\nMore example requests:\n\n```text\nTurn this book into a book-sharing deck; generate images with GPT-Image 2.0.\nMake a lab-meeting PPT from this report, following the template style I uploaded.\nImage PPT: convert this Markdown into an editable 16:9 PPTX.\n```\n\n## Highlights\n\n- 🧠 **Reads the material**: extracts author background, structure, key ideas, examples, quotes, and takeaways\n- 🎨 **Four style previews**: 4 previews with different colors/layouts/visual styles — pick one before rendering\n- 🖼 **Page-by-page rendering**: one core idea per"}],"languages":[],"docsSourceLabel":"CLAWHUB","editorialOverview":"图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。 Skill: image-ppt Owner: helloo1568 Summary: 图片PPT（image-ppt）：将书籍、PDF 或任意文字材料转化为精美可编辑 PPT 的工作流技能。推荐运行环境：Codex + GPT-Image 2.0。适用于课堂汇报、读书分享、组会汇报、项目汇报、比赛路演等场景。通过三步流程（内容提炼与风格设计、图片版PPT生成、可编辑PPTX还原）完成从原始文档到可编辑演示文稿的全链路转换。平台无关：也可在任何具备文档阅读、图像生成与文件输出能力的 AI 助手中使用。包含三段核心提示词。别名：图片PPT、image-ppt、doc-to-editable-ppt。 Tags: latest:0.1.0 Version history: v0.1.0 | 2026-08-08T02:23:48.967Z | auto Initial release of image-ppt skill. - Pr","editorialQuality":{"score":100,"threshold":65,"status":"ready","wordCount":923,"uniquenessScore":48,"reasons":[]}},"media":{"evidence":{"source":"no-media","verified":false,"confidence":"low","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":"No screenshots, media assets, or demo links are available."},"primaryImageUrl":null,"mediaAssetCount":0,"assets":[],"demoUrl":null},"ownerResources":{"evidence":{"source":"unclaimed","verified":false,"confidence":"low","updatedAt":"2026-10-09T15:36:08.503Z","emptyReason":"This page has not been claimed by the agent owner."},"hasCustomPage":false,"customPageUpdatedAt":null,"customLinks":[],"structuredLinks":{"docsUrl":null,"demoUrl":null,"supportUrl":null,"pricingUrl":null,"statusUrl":null},"customPage":null},"relatedAgents":{"evidence":{"source":"protocol-neighbors","verified":false,"confidence":"medium","updatedAt":"2026-10-10T06:43:10.755Z","emptyReason":null},"items":[{"id":"8ebccd8e-3863-4187-8355-c3f14e1f9edf","entityType":"agent","canonicalPath":"/agent/iofficeai-aionui","slug":"iofficeai-aionui","name":"AionUi","description":"Free, local, open-source 24/7 Cowork app and OpenClaw for Gemini CLI, Claude Code, Codex, OpenCode, Qwen Code, Goose CLI, Auggie, and more | 🌟 Star if you like it!","url":"https://github.com/iOfficeAI/AionUi","homepage":"https://www.aionui.com","source":"GITHUB_REPOS","protocols":["MCP","OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-10-09T19:11:12.944Z","createdAt":"2026-02-25T03:38:16.584Z","downloads":null},{"id":"b917f68a-ebff-438e-84f8-3f4b2494c0bc","entityType":"agent","canonicalPath":"/agent/activepieces-activepieces","slug":"activepieces-activepieces","name":"activepieces","description":"AI Agents & MCPs & AI Workflow Automation • (~400 MCP servers for AI agents) • AI Automation / AI Agent with MCPs • AI Workflows & AI Agents • MCPs for AI Agents","url":"https://github.com/activepieces/activepieces","homepage":"https://www.activepieces.com","source":"GITHUB_REPOS","protocols":["OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-04-15T02:22:12.426Z","createdAt":"2026-02-25T03:38:12.412Z","downloads":null},{"id":"5cb26759-3a39-483f-94cf-276a98c13bb8","entityType":"agent","canonicalPath":"/agent/cherryhq-cherry-studio","slug":"cherryhq-cherry-studio","name":"cherry-studio","description":"AI productivity studio with smart chat, autonomous agents, and 300+ assistants. Unified access to frontier LLMs","url":"https://github.com/CherryHQ/cherry-studio","homepage":"https://cherry-ai.com","source":"GITHUB_REPOS","protocols":["MCP","OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-04-11T14:38:40.986Z","createdAt":"2026-02-25T03:38:19.379Z","downloads":null},{"id":"6f6582d0-5d76-4f0f-b81d-86520247950b","entityType":"agent","canonicalPath":"/agent/copilotkit-copilotkit","slug":"copilotkit-copilotkit","name":"CopilotKit","description":"The Frontend for Agents & Generative UI. React + Angular","url":"https://github.com/CopilotKit/CopilotKit","homepage":"https://docs.copilotkit.ai","source":"GITHUB_REPOS","protocols":["OPENCLAW"],"capabilities":[],"safetyScore":100,"overallRank":70,"updatedAt":"2026-03-25T09:50:57.846Z","createdAt":"2026-02-25T03:39:14.617Z","downloads":null}],"links":{"hub":"/agent","source":"/agent/source/clawhub","protocols":[{"label":"OpenClaw","href":"/agent/protocol/openclew"}]}}}