包含 extensions、skills、prompts、settings、auth、models、mcp 等配置。 排除 node_modules、npm 缓存、sessions 等运行时数据。
15 KiB
常见问题
Q: PPT Master 支持哪些源文件格式?
几乎所有常见格式都支持:PDF、DOCX、PPTX、EPUB、HTML、LaTeX、RST、网页链接(包括微信公众号文章)、Markdown,或者直接在对话中粘贴文字内容。AI 代理会自动将源材料转换为 Markdown 后再生成幻灯片。
Q: 只有一个主题或想法、没有任何资料,也能生成吗?
可以。直接告诉 AI 你想做的主题或场景(如"做一个关于宫崎骏的 PPT"、"介绍我们公司新产品"),AI 会自动启动 topic-research 工作流——通过网页搜索抓取权威来源(Wikipedia / 官网 / 机构发布),整理成 Markdown 资料文档 + 配图集后再走主流程生成幻灯片。
效果取决于公开网页的覆盖度。如果你已有专业资料(论文、内部文档),直接把文件给 AI 比联网检索更准。
Q: 除了 PPT 还能生成其他格式吗?
可以。除了标准的 16:9 和 4:3 演示文稿格式,PPT Master 还内置了社交媒体和营销类格式:
| 格式 | 适用场景 |
|---|---|
| 小红书 3:4 | 图文分享、知识帖 |
| 微信朋友圈 / IG 1:1 | 方形海报、品牌展示 |
| Story / 抖音 9:16 | 竖版故事、短视频封面 |
| 微信文章头图 | 公众号文章封面 |
| A4 印刷 | 印刷海报、传单 |
创建项目时指定格式即可(如 --format xhs)。输出仍然是包含原生形状的 .pptx 文件。
Q: PPT Master 支持哪些 AI 工具?
PPT Master 可以在任何能读取文件和执行命令的 AI 编程代理中运行——Claude Code(CLI / VS Code / JetBrains / Web)、VS Code Copilot、Codex 等均可使用。不同工具的使用成本可参考下方的费用对比。
Q: 能用 AI 生成配图吗?
可以。PPT Master 内置了图片生成脚本,支持多个供应商(Gemini、OpenAI、FLUX、通义千问、智谱等)。在策略师阶段选择"AI 生图"方案后,流程会根据内容自动生成配图。你也可以使用自己的图片——只需放到项目的 images/ 目录下即可。
Q: 没有生图 API Key,还能配图吗?
可以——在策略师的"图片方案"步骤选择"网络图片"。PPT Master 内置了零配置的 image_search.py,在 Openverse 和 Wikimedia Commons 中搜索可商用的开放许可图片(无需 API Key)。零配置搜索适合作为兜底:能直接用,但图片质量不稳定,容易出现普通用户上传、构图随意、清晰度一般的素材。
如果想要更现代的商业风照片,建议在 .env 里设置 PEXELS_API_KEY 和/或 PIXABAY_API_KEY(都是免费申请)。搜索会自动纳入 Pexels / Pixabay,人物、办公、生活方式、产品和插画类图片质量通常会明显更稳定。两种路径可以在同一份 deck 里混用(比如 hero 图用 AI 生成、团队照片用网络搜索);如果选中的图片需要署名,Executor 会在该幻灯片自动添加就地小字署名。
Q: 生成的 PPT 可以编辑吗?
可以。主 .pptx(原生 PowerPoint 形状,文字、图形、颜色均可直接编辑,无需转换)以时间戳命名保存至 exports/。Executor 的原始 SVG 源(svg_output/ 副本)始终镜像到 backup/<timestamp>/svg_output/,便于归档或基于该版重跑 finalize_svg → svg_to_pptx 重建 pptx,无需再走 LLM。加 --svg-snapshot 会额外在 exports/ 内并排生成 SVG 快照版 pptx,便于跨平台单文件分发;默认关闭——日常开发/诊断场景中 live preview 已经提供了 SVG 视觉参考。需要 Office 2016 或更高版本。
Q: 为什么一段正文被拆成了好几个文本框?能不能一段一个文本框?
默认会把可合并的正文段落导出成一个可编辑的 PowerPoint 文本框,内部保留多个段落。拉伸框时文字会在框内自动重排。
如果你需要严格保持逐行版式,重新导出时加上 --no-merge:
python3 skills/ppt-master/scripts/svg_to_pptx.py <project_path> --no-merge
使用 --no-merge 时,SVG 里的每一视觉行都会变成一个独立的 PowerPoint 文本框。这样能逐像素保留 SVG 的版式,适合封面、图表、表格、以及任何对版式精度敏感的页面。
代价:默认段落合并后,PowerPoint 自动换行的行数可能与原 SVG 不一致。默认更适合正文密集型页面(abstract、多段落章节、参考文献等);版式敏感页面使用 --no-merge。判定足够保守——非段落型 <text> 会自动落回按行拆框路径。
跟 AI 对话时也可以直接说:"这个页面要严格保持逐行版式" —— AI 重新导出时会加上 --no-merge。
Q: 三种执行师有什么区别?
- Executor_General: 通用场景,灵活布局
- Executor_Consultant: 一般咨询,数据可视化
- Executor_Consultant_Top: 顶级咨询(MBB 级),5 大核心技巧
Q: 用 PPT Master 做 PPT 贵吗?
PPT Master 本身免费开源,唯一的成本来自你自己的 AI 模型用量。
目前主流 AI 工具都已转向按量计费——用多少付多少。PPT Master 天然契合这一模型:不需要额外订阅 PPT 平台、没有专有积分、没有按人头收费的演示工具费用。
作为对比,Gamma 订阅 $8–20/月,Beautiful.ai $12–45/月——无论用多少都得付这个底价。PPT Master 在你现有 AI 支出之外不增加任何额外成本。
Q: 生成的图表可以编辑数据吗?
图表以自定义设计的 SVG 图形形式渲染,转换为原生 PowerPoint 形状——形状级别完全可编辑(移动、改色、改文字、调样式)。这是一个有意为之的选择,而不是 Excel 驱动的图表对象:PowerPoint 默认图表样式陈旧、视觉受限于固定模板。SVG 图表则提供出版物级的视觉质量,并且可以在 PowerPoint 中直接精修。
如果你的工作流明确需要 Excel 驱动的数据编辑,可以在导出后自己手动在 PowerPoint 里制作一张类似的原生图表。
Q: 页面切换和元素动画可以调吗?
可以。页间转场(默认 fade 0.4s)和页内元素入场动画(默认 auto 效果 + after-previous 自动级联,根据每个 group 的 SVG id 自动映射效果——图片类 id 在视觉池中循环以产生 deck 内变化)都通过 svg_to_pptx.py 的参数控制——-t/--transition 控制页级,-a/--animation 控制元素级。常用一行命令:
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t push # 换转场效果
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t none # 关闭转场
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -a none # 关闭页内动画
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation fade # 改用单一效果(仍是默认级联)
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation-trigger on-click # 改为单击触发,演讲者控制节奏
on-click 适合现场演示。通过 --recorded-narration 做旁白/视频导出时会拒绝它,因为 PPT Master 只写页面级计时,不生成对象级点击计时;带旁白的 deck 请使用 after-previous 或 with-previous。
完整效果列表、<g id="..."> 锚点机制、降级行为、限制:见 转场与动画。
Q: 推荐用什么 AI 模型?
Claude(Opus / Sonnet)是推荐且测试最充分的模型。SVG 排版本质上是在绝对坐标系中做精确的数学计算(字号 x 字数 x 容器宽度),Claude 在这方面表现明显优于其他模型。
GPT 系列早期版本排版问题较多——文字超出容器、元素错位、坐标计算失误。较新的版本(如 GPT-5.5)在这方面已有明显进步,实际效果可以接受;如果遇到问题,可以告知 AI 修正具体页面。
其他模型(Gemini、GLM、MiniMax 等)效果参差不齐。总体来说,前端/视觉能力越强的模型,生成效果越好。
Q: 有人说 PPT Master "只是个玩具"——这个评价准确吗?
不准确。PPT Master 是一个 harness,不是完整的 agent——harness + model = agent,输出上限完全由模型决定,而不是由 harness 本身决定。用弱模型或小上下文窗口来评价 PPT Master,就好比挂着一档开跑车然后说它跑不快。
发挥完整实力的组合:
- Claude 大上下文窗口(推荐 ~100 万 token 级别):大上下文让 Executor 在同一个会话里看到全部已生成页面,在不拆分运行的前提下保持整份 deck 的视觉一致性。上下文不足时被迫走拆分模式,两段之间会出现明显的风格漂移。
- AI 生图,推荐
gpt-image-2(或同等质量):配图水平是 deck 整体观感的最大变量。用占位级的网络图片和用真正贴合内容的 AI 生成图,视觉效果完全是两个量级。
如果你看到的效果差强人意,先对照以下几点检查你的配置,再下结论:用的什么模型?上下文开了多大?有没有接入图片生成 API?同样的工作流,Claude Opus 配 100 万 token 上下文配 gpt-image-2 的结果,和小参数开源模型配零配置的结果,是截然不同的体验。
harness 决定工作流上限,model 决定质量上限。 如果 agent 能力不达预期,请先升级模型,再来评价 harness。
没有 Claude 渠道? 本项目赞助商 PackyCode 提供 Claude 及其他主流模型的按量付费接入——无需订阅,无需境外信用卡,支持国内支付,开箱即用。充值时填写优惠码
ppt-master享 9 折。
最后再说一句:这是一个免费、个人维护的开源项目。合用就用,能帮到你我很高兴;不合用,换个工具就好。真诚的反馈与建议始终欢迎——这也是项目一点点变好的方式。
Q: 文字超出边框 / 元素错位怎么办?
这几乎都是模型能力问题,不是 PPT Master 的 bug。SVG 排版是纯手动绝对定位——模型必须准确计算坐标、字体度量和容器尺寸。
解决办法:
- 切换到 Claude(Opus 或 Sonnet),如果你用的是其他模型
- 告诉 AI 哪一页有问题、具体是什么问题——它可以单独重新生成某一页
- 直接打开 SVG 源文件,让 AI 修正坐标
- 记住:生成的 PPTX 是高质量起点,不是最终成品——在 PowerPoint 中做少量调整是正常的
Q: 生成一份 PPT 要多久?
一份典型的 10–15 页 PPT 大约需要 10–20 分钟(使用吞吐较快的模型)。生成流程是故意串行的(逐页生成),这样才能保持前后页面的视觉一致性——并行生成方案曾经测试过,结果是各画各的、缺乏整体观。
如果感觉生成很慢,检查一下模型的 token 吞吐速度。瓶颈通常在模型的输出速度,而不是脚本本身。
Q: 长 PPT 一次生成会不会上下文爆掉?
默认推荐一次性连续生成——10–15 页的 deck 在 200K 上下文窗口下完全够用,跨页视觉一致性也最好(Executor 看到前几页 SVG 后会主动对齐风格、字号、节奏)。
只有信号偏重的场景(页数 ≥ 18 / 源材料很厚 / 走过 topic-research 累积大量 web 抓取),AI 才会在策略师阶段给出**两段式(拆分模式)**的可选提示:第一阶段(八项确认 + 图片获取)结束后停止当前对话;你新开聊天窗口,输入 继续生成 projects/<项目名> 进入第二阶段(SVG 生成 + 导出)。新会话从磁盘重新加载 design_spec / spec_lock / sources / images 继续执行。
两段式是折中方案——付出约 6K tokens 的 SKILL.md 重读成本,换得 60–200K 的 Phase A 噪声丢弃,并把节省下来的窗口空间用于 Phase B 主动重读 sources/ 做内容增稠。信号正常时不需要,提示也不会出现;用户随时可以忽略提示,走默认连续模式。
Q: 能在导出前预览或修正某一页吗?
可以。你可以随时中断工作流——前几页生成后就可以查看并反馈意见。AI 可以根据你的意见重新生成特定页面,不需要等到全部完成再修改。
生成后的修正也一样简单,直接告诉 AI:"第 3 页布局有问题——标题和图表重叠了",它会修正那个特定的 SVG。
Q: 我已经有一份做好的 .pptx,能不能复用它的设计、只填新内容?
可以——这就是 套模板(template fill) 路径,独立于 SVG 生成管线。把你现成的 .pptx 连同素材(或一个主题)给 AI,说「套模板 / 把这些填回去」。它会把你的 deck 当作原生页面库,只挑适合新内容的页面(可乱序、可重复),把新文字——以及原生表格单元格、图表数据——直接写回原始 OOXML。
输出仍是 100% 原生可编辑的 PowerPoint:原设计、母版、图片、动画都保留,且只导出选中的页面。它刻意不改版式、不加页、不换图——一份 deck 的页面结构本身承载着逻辑(总分、对比、递进),所以应挑选结构本就契合内容的页面,而不是硬塞进去。若需要全新结构或不同页数,请改用 create-template(见下一问)。完整步骤:套模板工作流。
Q: 如何制作自定义模板?
想把自己喜欢的 PPT 模板制作成 PPT Master 可调用的模板?按以下步骤操作:
第一步 — 准备参考材料
最推荐的方式是直接给原始 .pptx 文件。当前的 PPTX 导入管线能做到接近高保真还原——PPT Master 会从 PPTX 中提取主题色、字体、母版/版式结构、可复用图片资源(包括精灵图裁剪关系),再用这些素材重建出干净可维护的模板。封面、章节、装饰繁复的页面都能稳定还原,这是目前最靠谱的派生路径。
没有源 PPTX 时,截图集也能跑(cover.png / toc.png / chapter.png / content.png / closing.png),但保真度会明显下降。建议优先找原始 PPTX。
第二步 — 让 AI 创建模板
使用 AI 编程代理(Claude Code、Codex 等),要求它使用 PPT Master 的 /create-template 工作流,将这些参考材料转换成模板。提供的信息越详细,效果越好,例如:
- 模板名称和适用场景(如政府汇报、高端咨询、产品宣讲等)
- 期望的风格基调和配色(如"现代克制、深蓝主色调")
- 类别偏好(
brand品牌 /general通用 /scenario场景 /government政务 /special特殊) - 画布格式(默认 16:9,如需其他格式请注明)
不需要一次提供所有细节——AI 代理会通过对话追问补齐缺失信息(模板 ID、主题模式等)。
第三步 — 等待完成
AI 代理会自动完成后续工作 — 分析截图、构建布局定义、注册模板,使其出现在 PPT Master 工作流的模板选项中。
提示:对风格和使用场景描述得越具体,生成的模板就越符合你的预期。
更多问题可先查看 skills/ppt-master/SKILL.md 与 AGENTS.md