有了这个 Skill,图片秒变可编辑 PPT!
手里只有一张 PPT 截图,领导却让你「把里面的字改一下」——图片里的文字不能点、形状不能拖、排版不能调。Image to Editable PPT Skill 干的就是这件事:把图片、PDF、图片版 PPT,尽量重建成可编辑的 PowerPoint。
你有没有遇到过这种场景:图片里的文字不能点、形状不能拖、图标不能改、排版不能调,只能整张图当背景。改一两个字还能硬糊,要改一整页基本等于重新做一遍。最近看到一个开源 Skill —— Image to Editable PPT Skill —— 就是来解决这个痛点的。
这个 Skill 到底能做什么?主要处理 3 类输入
第一类:图片
PPT 截图、课程截图、科研图示、汇报页截图、AI 生成的幻灯片图片——你可以让它把图片重建成一页可编辑 PPT。
第二类:PDF
论文里的图示页面、课程讲义 PDF、会议资料 PDF、图片版报告——它可以把多页 PDF 拆成多页 PPT 来处理。
第三类:图片版 PPTX
有些 PPT 看起来是 .pptx,但每一页其实都是一张图片——你在 PowerPoint 里打开后发现根本改不了文字,只能拖整张图。这个 Skill 正适合处理这种情况。
它适合哪些人?
- 研究生 / 科研党 —— 论文综述图、实验流程图、模型结构图想拿来做组会汇报或答辩 PPT,以前要重画,现在可以先重建再人工改字改色改结构。
- 老师 / 学生 —— 老师手里的 PDF 课件想改成 PPT,学生看到一页资料图想拆成汇报页。
- 职场汇报人 —— 别人发你一张方案截图让你改成正式汇报页,客户给的是图片版材料,你想转成可编辑文件。
- 内容创作者 —— 用 AI 生成了一张信息图,版式不错但想继续改文字、改模块、改图标。
- 科研绘图 / 知识图谱用户 —— 经常做流程图、综述图、结构图,这类图片转可编辑 PPT 的需求会比较多。
它不适合什么场景?
- 不适合从 0 生成新 PPT。 那类需求更适合 PPT 生成类 Skill。Image to Editable PPT 是「重建旧页面」,不是「生成新内容」。
- 不适合低价值页面。 普通封面、简单文字页,重新做可能比转化更快。别什么图都丢进去——它更适合结构复杂、手动重画麻烦、后续还要继续编辑、页面价值较高的情况。
- 不适合追求 100% 像素级还原。 AI 重建不是专业排版软件的逆向工程,可能出现字体不完全一致、位置轻微偏移、复杂图形被保留为图片、部分文字识别不准、版式需人工微调。
小白怎么用?
如果你已经在支持 Skill 的环境里使用 Codex / Claude Code / Cursor / OpenCode,可以尝试安装这个 Skill。安装方式以项目 README 为准,常见思路是添加这个开源仓库:
安装完成后可以这样调用:
一个实用的提示词模板
通用图片,可以直接复制这个:
如果是科研图:
如果是 PDF:
使用前一定要知道的 4 个坑
- 坑一:它不一定快。 多页重建可能很耗时间,复杂页面需要多轮检查和修正,别把「秒变」当成真实承诺。
- 坑二:它会消耗较多 token。 这类重建任务比普通文字任务重很多,简单页面不一定值得用。
- 坑三:效果不是 100% 还原。 字体、位置、图形、排版可能需要人工修。
- 坑四:敏感文件别乱传。 公司、客户、合同、隐私类材料先脱敏再处理。
最后总结
Image to Editable PPT Skill 适合解决一个非常具体的问题:把图片、PDF、图片版 PPT 尽量重建成可编辑 PowerPoint。适合科研汇报、论文答辩、课程课件、职场汇报、图片版 PPT 修复、AI 生成幻灯片二次编辑。
- 它不是从 0 生成 PPT 的工具
- 它不是 100% 还原神器
- 它不是所有页面都值得用——它更适合高价值页面重建
如果你手里刚好有一张想改字、想改结构、但只能当图片看的 PPT 截图,这个 Skill 确实值得试一试。
claude-opus-4-8)和 Codex(gpt-5.5),新手也能直接开始。打开控制台创建 Key →