🛍️ 更多精选好物 ›
📊 公开数据一览
| 📦 榜单安装量 | 1.1K |
| ⭐ GitHub Stars | 1,836(fork 102) |
| 🗓️ 最近推送 | 2026-07-28 |
| 🌱 项目创建 | 2026-05-21 |
| 💻 语言 / License | Python · MIT |
| 🐛 开放Issue | 2 |
📝 工具简介
Codex技能,可将幻灯片图片、PDF和基于图片的PPTX文件转换为可编辑的PowerPoint演示文稿。
📖 怎么用
安装这个 skill,地址是 `https://github.com/ningzimu/image-to-editable-ppt-skill`。建议在 Codex 里用“完全访问权限”跑,不然会老被打断。装好后直接发指令,比如“`$image-to-editable-ppt 把这张图片转成可编辑 PPT`”或“`$image-to-editable-ppt 把 <path-to-deck.pdf> 转成可编辑 PPT`”。它会自动把图片、PDF 或图片版 PPT 转成 .pptx,文字恢复成文本框、简单图形变成形状,复杂图保留为图片。输出在 `output/image-to-editable-ppt/{job-id}/` 目录。想校正文字框和字号,可以配百度 PaddleOCR VL 的 Token,不配也能跑。
📋 迷你测评
Codex技能,把幻灯片图片、PDF转成可编辑PPT。亮点是解决“图片版PPT没法改”的痛点。直接输出pptx格式,省去重新排版。
📄 README 要点
这个技能能把图片、PDF 或图片版 PPT 转成可编辑的 PowerPoint 文件。它会先把输入拆成逐页任务,再重建为 .pptx 格式,文字尽量恢复成原生文本框,简单几何图形变成 PowerPoint 形状,复杂视觉元素则保留为带来源记录的独立图片。建议在 Codex 里用完全访问权限跑,因为流程很长,会自动做 OCR、图片生成编辑、文件读写和子 agent 分派,请求批准模式会频繁打断。转换时会调用百度 PaddleOCR 校正文字框,图片生成优先用 Codex 内置工具。整体比较费 token,推荐 ChatGPT Pro 用户用,适合需要把截图式幻灯片变成可二次编辑 PPT 的场景。
查看英文原文
Image to Editable PPT Skill 简体中文 · English · 한국어 一个用于把图片、PDF、图片版PPT 转成可编辑 PowerPoint 的 skill。它先把输入归一化为逐页任务,再重建为 .pptx :可读文字尽量恢复为原生文本框,简单几何尽量恢复为 PowerPoint 形状,复杂视觉元素保留为带来源记录的独立图片资产。 它适合把截图式或图片式幻灯片变成更容易二次编辑的 PPT,让文字、简单形状和视觉素材尽量分开调整。 [!IMPORTANT] 建议在 Codex 中使用“完全访问权限”执行本 skill。 本 skill 运行时间较长,并且会自动执行 OCR、图片生成/编辑、文件读写、子 agent 分派和长时间轮询等步骤。“请求批准”模式会频繁打断执行,可能阻塞部分步骤,尤其是在子 agent 环境里。 “替我审批”模式已知仍可能在 OCR 阶段、ChatGPT 图片生成/编辑阶段或第三方 API 调用阶段拦截请求,要求你手动审批;如果你不在电脑旁,转换流程会停住。 本 skill 会在转换过程中自动调用百度 PaddleOCR VL 接口(如果已配置 Token)来校正页面文字框、字体大小和字号分组。图片生成/编辑会优先调用 Codex 内置 image gen.imagegen ;只有内置工具不可用、调用报错、编辑输入不可读或没有返回有效本地图片时,才降级到 editppt image (Codex OAuth → OpenAI compatible API)。这些调用是把图片式页面重建成可编辑 PPT 的必要步骤。 [!WARNING] 目前该skill 采用了多智能体协作复原流程,有着复杂的流程控制,不是轻量转换器。AI 会执行“ 重建 → 自我检查 → 页面内修正 ”的循环,并可能进行多轮迭代,直到它认为结果足够接近原图。在这个过程中,page worker 可能会对页面做很 多轮尝试 ,因此整体上比较费 token。 推荐 ChatGPT Pro 用户使用;Plus 用户请谨慎使用。 复原一个 10 页 PPT 有可能消耗完你的 5 小时额度。单页PPT复原时间可能在10min以上。单页/单图输入可由主 agent 按同一页面重建流程本地执行;多页输入会按并发槽位分派给 page worker 处理。 如果没有强烈的可编辑需求,请不要使用这个 skill。 更轻量的做法是直接使用 gpt image 2 的图像编辑能力:把你不满意的那一页 PPT 图片发给它,让它针对性修改,并返回修改后的图片。 [!TIP] 本 skill 不负责从文章、报告、大纲或想法直接生成全新 PPT。如果你要做的是“生成一份 PPT”,可以使用 codex ppt skill。 关于 codex ppt 和 image to editable ppt 这两个技能的详细介绍,参见 skill duo intro.pdf。该 PPT 由 codex ppt skill 生成,提示词为:“请分别阅读 Codex PPT和 Image to Editable PPT 这两个技能的内容,然后用 Codex PPT 帮我做一个PPT吧,20页,每个技能的介绍10页。” 另外,关于这个可编辑 PPT Skill 设计和调优的实践经验,可以看这篇文章:2000 个 GitHub Star 换来的经验:好的 AI Skill 是调出来的,不是写出来的。 转换效果示例 原图 转换后可编辑效果 特点 适用场景广泛,支持多种输入:单张图片、多张图片、多页 PDF、图片版PPT 到可编辑 .pptx 。 单页/单图输入可由主 agent 本地执行同一页面重建流程;多页输入由主 agent 分派给 page worker/subagent,并按 max concurrent pages 并行处理。 图片生成和编辑优先使用 Codex 内置 image gen.imagegen ;满足明确降级条件时才进入 editppt image CLI,由 CLI 依次选择本机 Codex OAuth 和 OpenAI compatible API。 第三方 API fallback 配置保存在 /.editppt/config.yaml ;Windows 下对应 %USERPROFILE%\.editppt\config.yaml 。 文字大小与位置由测量驱动:prepare 阶段为每页生成文字标注(框坐标 + 字号 + 字号分组),模型按测量值还原文字,同级文字字号自动保持一致。 多张图片按提供顺序生成页面;PDF 和 .pptx 保留原页码顺序。 .pptx 输入的页面备注会复制到输出对应页,备注内容不改动。 根据具体页面情况决定是
💬 评论(0)
交流使用体验、避坑建议;违规内容将被删除