PPT Master 新手完整指南:十分钟把文档变成可编辑的 AI 演示文稿
【免费下载链接】ppt-masterAI turns documents or topics into real, native PowerPoint decks—with native shapes, transitions and animations,>项目地址: https://gitcode.com/GitHub_Trending/ppt/ppt-master
PPT Master 是一个开源的 AI 演示文稿生成工具,它把 PDF、网页、Markdown 甚至一个主题,转换成可以在 PowerPoint 里逐个对象编辑的.pptx文件。具体流程是:把一份报告 PDF 丢进projects/目录,在 AI 聊天面板里说一句"用这份材料做一份 PPT",工具在本地完成内容分析、页面设计、SVG 绘制和 PPTX 导出,最后给你一个原生 PowerPoint 对象组成的可编辑文件。本文按"看效果 → 装环境 → 出第一份 PPT → 进阶用法 → 避坑"的顺序讲完整个过程。
先看效果:AI 生成的 PPT 到底长什么样
README 里的示例画廊由 Claude Opus 4.7 搭配gpt-image-2一次性生成,没有人工精修。产出不是截图拼贴,而是完整的 PowerPoint 对象模型:带调整手柄的原生形状和连接线、文本框、渐变与填充效果,走模板或结构化路线时还包含真正的幻灯片母版和布局(p:sldMaster/p:sldLayout继承)。
它的能力边界,用一张表说清楚:
| 能做 | 边界说明 |
|---|---|
| 每个形状、文本框、图表都是原生 PowerPoint 对象 | 在 PowerPoint、Keynote、WPS、LibreOffice 里都可以点开继续编辑 |
| 幻灯片母版与布局 | 通过模板/结构化路线输出p:sldMaster/p:sldLayout继承结构;自由设计路线输出扁平结构 |
| 过渡与动画 | 默认fade页面过渡、无元素动画;对象动画(进入/强调/路径/退出,203 个原生预设)需用-a auto等方式显式开启 |
| 图表与表格 | 默认导出为可逐个编辑的 SVG 衍生 DrawingML 形状,跨软件渲染一致;需要可编辑数据的原生图表对象时传--native-charts-and-tables |
| 音频旁白与视频 | 演讲者备注可转成逐页语音嵌入 PPTX,再用 PowerPoint 导出同步旁白 MP4 |
| 多比例画布 | 16:9、4:3、小红书 3:4、方形 1:1、竖版 9:16、A4 等 8 种格式,输出仍是.pptx |
| 不能做 / 需要预期管理 | 说明 |
|---|---|
| SmartArt | 刻意不支持,不是遗漏 |
| 一次生成即交付的完美终稿 | 官方定位是高质量可编辑草稿,最后的润色留给你 |
| 在非 PowerPoint 软件里验证动画 | 动画的主要验证目标是 Microsoft PowerPoint,其他软件能打开文件但个别效果可能被重映射 |
| 快速模式断点续传 | 快速生成是一次性流程,上下文丢失需要重跑 |
五分钟上手:安装 PPT Master 的完整步骤
环境要求
两样东西:
- Python 3.10+,其他依赖一行命令装完。Windows 用户需要额外配置 PATH 和运行策略,仓库提供了逐步安装的 Windows 指南。
- 一个有 agent 能力的 AI 工具。它在这个项目里只扮演一个角色:一个能读写文件的 AI 聊天窗口。IDE 内置 agent(VS Code、Cursor、Zed 等)、IDE 插件(Claude Code、GitHub Copilot、Cline 等)、CLI agent(Claude Code CLI、Codex CLI、Gemini CLI 等)都可以,你只会用到它的聊天面板,不需要写代码。
安装
git clone https://gitcode.com/GitHub_Trending/ppt/ppt-master cd ppt-master pip install -r requirements.txt也支持下载 ZIP 包或从 skill 市场安装(npx skills add hugohe3/ppt-master),只取技能文件约 56 MB,但装完同样要pip install -r requirements.txt。
放文件,发一句指令
在 AI 工具中打开
ppt-master文件夹(IDE 用 File → Open Folder,CLI agent 先cd ppt-master)。把 PDF、DOCX、图片等源材料放进
projects/目录;也支持直接把文字粘贴进聊天窗口。在聊天面板里告诉它要做什么,例如:
请根据 projects/q3-report/sources/report.pdf 创建一份 PPT
默认流程下,AI 会先和你确认设计规范(模板还是自由设计、画布格式、页数),然后自动完成内容分析、视觉设计、SVG 生成和 PPTX 导出。想跳过确认环节,直接说明即可:"快速生成一份 5 页的 deck,不用跟我确认"——你明确说出的都会被遵守,没说的由 agent 自行决定。
最终文件输出到exports/<名称>_<时间戳>.pptx,生成期间还会在http://localhost:5050打开浏览器实时预览,你可以直接选中元素改文字、颜色、位置,点"Apply changes"写回svg_output/,也可以标注后让 AI 重写那一页并重新导出。完整流程见快速入门指南。
输入与风格:你能喂给它什么,它能长什么样
输入格式
| 输入类型 | 格式 |
|---|---|
| 文档 | PDF、DOCX、PPTX、EPUB、HTML、Jupyter notebook |
| 传统文档格式 | LaTeX、RST、.doc、.odt、.rtf等(需要额外安装 Pandoc) |
| 网页 | URL(含微信文章) |
| 纯文本 | Markdown、普通文本、直接粘贴的内容 |
| 只有主题 | 比如"做一份关于宫崎骏的 PPT",AI 会先做主题研究补齐事实基础 |
源材料会被自动转成 Markdown 再生成幻灯片。如果你手头有论文、内部文档这类专门材料,直接给文件比让 AI 自己上网检索效果更好。
叙事模式
叙事模式决定论证如何组织,每份 deck 选一个,与视觉风格相互独立:
| 模式 | 骨架 | 适合场景 |
|---|---|---|
pyramid | 结论先行,结构化论证 | 决策支持、分析、董事会汇报 |
narrative | 情境 → 张力 → 解决的叙事弧 | 路演、案例研究、融资 |
instructional | 概念拆解、循序渐进 | 培训、教程、知识分享 |
showcase | 视觉优先,大图大数字 | 发布会、品牌展示、活动 |
briefing | 中立完整、可扫描、无立场 | 状态汇报、参考手册、会议纪要 |
视觉风格
内置 18 种视觉风格,可以与任意叙事模式自由组合。从examples/目录的 15 个示例项目能直观看到跨度:Swiss-minimal(严格网格、克制排版)、Data-journalism(暗色数据仪表盘)、Glassmorphism(半透明层次)、Dark-tech、Brutalist、Ink-wash(水墨)、Memphis-pop(波普几何)、Risograph-zine(双色印刷风)等。也可以用自然语言描述自定义方向,AI 会基于目录里的风格做混合或推演。
进阶玩法
复用你现有的 PPT 模板
已有设计不错的.pptx时,有两条路线:
| 你想要 | 路线 | 会发生什么 |
|---|---|---|
| 保留这份 deck 的原始页面外壳,换上新内容 | Fill Native PPTX | 克隆指定源页面,直接在 OOXML 里替换文本/表格/图表数据,输出新的填充版 deck |
| 沉淀成可复用的设计系统,之后生成新 deck | Create Template | 从参考件提炼出 Brand、Style、Layout 或 Deck 工作区,之后的新 deck 页数、结构都可以不同 |
用法都是在聊天里下指令:
用这份 deck 的版式填入新内容:projects/brand/our_deck.pptx
或者
Create a reusable Deck template from projects/brand/our_deck.pptx via /create-template
模板工作区可以注册在skills/ppt-master/templates/下供全局调用,也可以放在具体项目里。详细说明见模板指南。
图像获取策略
非用户提供的图片有两条路径,同一份 deck 里可以逐张混用:
| 路径 | 配置成本 | 特点 |
|---|---|---|
| AI 生成 | 需要IMAGE_BACKEND+ 对应 API key,或直接用宿主 AI 工具自带的生图能力 | gpt-image-2是目前的最佳默认值;封面、产品图、人物场景建议优先用这条 |
| 网络图片搜索 | 零配置即可用 | 默认走 Openverse / Wikimedia Commons,质量参差不齐;在.env里配免费的PEXELS_API_KEY/PIXABAY_API_KEY后质量明显提升 |
版权自动处理:CC0、Public Domain、Pexels/Pixabay 免署名许可、CC BY、CC BY-SA 都会被纳入考虑,需要署名的图片会在对应幻灯片上加一小行署名。
如何给 PPT 添加音频旁白
演讲者备注可以转成逐页语音,嵌入 PPTX 后再由 PowerPoint 导出同步旁白的 MP4,不需要第三方工具。指令示例:
Generate narration for this deck and re-export with audio embedded.
默认引擎是edge-tts(约 90 种语言),AI 会按 deck 语言推荐一个语音并只问你一次。还支持接入 ElevenLabs、MiniMax、Qwen、CosyVoice 克隆好的声音,让整份 deck 用你自己的声音(或演讲者的声音,需授权)朗读。细节见音频旁白文档。
选型与避坑
模型选择:模型决定上限
官方表述是harness + model = agent:PPT Master 只负责工作流,质量上限由模型决定。推荐的组合是大上下文窗口(约 100 万 token)的 Kimi K3 或 Claude,搭配 AI 生图(gpt-image-2或 Googlegemini-3.1-flash-image)。其他模型能跑通流程,但存在质量差距;结果不满意时,先升级模型,再对照文档和示例项目检查用法。
成本与数据方面一句话带过:工具本身 MIT 开源免费,你只付 AI 模型的使用费,没有订阅、积分或按席位收费;除与 AI 模型的正常通信外,源文档转换、SVG 生成、PPTX 导出全部在本地完成;它跑在任何支持 agent 的 AI 工具里,换 Claude、GPT、Gemini、Kimi 都可以,不存在平台锁定。
关键参数速查
| 参数 / 说法 | 作用 |
|---|---|
--native-charts-and-tables | 把符合条件的图表/表格替换为带数据的 PowerPoint 原生对象(支持 Edit Data),输出另存为_native_charts_tables.pptx变体 |
-a auto(或指定 203 个动画预设之一 /animations.json边车文件) | 开启对象级动画;默认只有fade过渡、无元素动画 |
--reflow-text | 恢复 PowerPoint 自动段落换行 |
--format xhs等 | 指定画布格式,如小红书 3:4、方形 1:1、竖版 9:16、A4 |
| "quickly generate / no need to confirm" | 快速模式:跳过确认交互,一次性导出 |
常见问题
| 情况 | 先试什么 |
|---|---|
| AI 跑偏、忘了某个步骤 | 让它重新读skills/ppt-master/SKILL.md和当前路线的工作流文件 |
| 文字溢出、元素重叠 | 重跑该页,或在实时预览里直接改 |
| 长 deck 撑爆上下文窗口 | 用 FAQ 里的分块生成模式 |
| 没有生图 API key | 用宿主工具的自带生图,或零配置网络搜索兜底 |
| 动画在其他软件里显示不对 | 以 PowerPoint 为准验收 |
| 更新到最新版 | python3 skills/ppt-master/scripts/update_repo.py(仅 git clone 安装) |
完整的故障排查在FAQ里持续维护,覆盖模型选择、成本、布局问题、导出问题和自定义模板。
下一步
PPT Master 的价值是把手工做 PPT 里最耗时的部分——内容梳理、页面设计、逐页绘制——交给 AI,同时交付的是可编辑的原生文件而不是图片。剩下的润色空间,正是它的设计意图。
- 快速入门指南:从模板到第一份 deck、实时预览、动画、旁白
- FAQ:模型选择、成本、排错
- 示例项目:15 个完整 deck,含设计说明、演讲者备注和 SVG 源文件
- 模板库:内置的布局、图标与模板资源
- 技术设计文档 与 PowerPoint ↔ SVG 映射指南:想了解原理再读
【免费下载链接】ppt-masterAI turns documents or topics into real, native PowerPoint decks—with native shapes, transitions and animations,>项目地址: https://gitcode.com/GitHub_Trending/ppt/ppt-master
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考