Sep 3, 2026

image-to-editable-ppt-skill:把幻灯片图片重建成可编辑的 PPT

ningzimu 的 2,306 星 Codex skill,把幻灯片图片、PDF 和图片版 PPTX 转成可编辑的 PowerPoint——文字还原成原生文本框,几何图形还原成形状,复杂视觉元素保留为独立图片资产。

#tutorial#agent-tools#productivity

有人给你发了一份很漂亮的 deck——截图版。或者是 PDF 幻灯片,或者是导出成图片的老 PPTX。内容都在,但每个字都是像素。ningzimu/image-to-editable-ppt-skill 把这些页面重建成可编辑的 .pptx:可读的文字还原成原生文本框,简单几何变成真正的 PowerPoint 形状,复杂视觉元素保留为带来源记录的独立图片资产。

为什么这个 Skill 重要

它的差异化靠测量,而不是目测。在准备阶段,每一页都会经过文字标注——框坐标、从源图实测的字号、同字号文字自动分组——模型按测量值还原文字,不靠猜。可选的 OCR 校正层通过免费的百度 AI Studio token 使用 PaddleOCR-VL;不提供 token 时,skill 退化为内置几何检测,文字还原质量打折扣。

这是一个重型的多 agent 重建流程,不是轻量转换器。单页输入由主 agent 本地处理;多页 deck 会分派给 page worker,按 max_concurrent_pages 并行执行,每个页面走"重建—自检—修正"循环,直到足够接近原图。

安装

README 文档化的是自然语言安装——把仓库地址发给 agent,它负责装好 skill 及其依赖的 editppt CLI:

Install the image-to-editable-ppt skill from
https://github.com/ningzimu/image-to-editable-ppt-skill

在 Codex 里用 $image-to-editable-ppt 显式调用。这个 skill 需要 agent 支持加载 skill、读写文件和执行 CLI;多页任务还需要子 agent 分派能力。

实战:把截图版 deck 送回工作流转

  1. 把幻灯片图片、PDF 或图片版 PPTX 附到对话里,然后提示:
$image-to-editable-ppt Convert this deck into an editable PPT.
  1. skill 把输入归一化为逐页任务,重建每一页,并按页序组装最终 .pptx。输入是 .pptx 时有一个值得知道的承诺:原页备注会原样复制到输出。
  2. 在 PowerPoint 里打开结果直接改字——同字号的文字行是分组还原的,字号自动保持一致。
  3. 把源图和输出页面对照,找出缺字、错位或校验器标记过的资产缺失。

技巧

  • 第一次跑之前先去申请免费的百度 AI Studio token——AI 只会问你要一次并写进用户级配置;有它文字还原质量明显更好。
  • 在 Codex 里开启完全访问权限运行;README 警告审批弹窗会打断 OCR 和图片生成阶段,可能卡死流程。
  • 图片生成优先用 Codex 内置的 image_gen.imagegen,不可用时回退到 Codex OAuth,再回退到 ~/.editppt/config.yaml 里配置的 OpenAI 兼容 API。
  • 预算要诚实:README 警告一个 10 页的 deck 可能耗尽你整个 5 小时使用窗口,单页可能超过 10 分钟。

何时不用这个 Skill

README 把账算得很直白:重建的成本可能达到生成图片版 deck 的 2-3 倍,gpt-5.5 以下模型的效果不作保证。如果你只是想改一张幻灯片,把那张图发给图片编辑器更划算。如果你的目标其实是从大纲生成新 deck,那是配套的 codex-ppt-skill 的活——这个 skill 重建已有页面,不写新内容。


查看 排行榜 了解更多 skill。