Files
sproutclaw-data/agent/skills-disabled/ppt-master/docs/zh/faq.md
shumengya 50edff80f5 feat: 导出 SproutClaw .sproutclaw 配置
包含 extensions、skills、prompts、settings、auth、models、mcp 等配置。
排除 node_modules、npm 缓存、sessions 等运行时数据。
2026-06-26 15:48:56 +08:00

194 lines
15 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# 常见问题
[English](../faq.md) | [中文](./faq.md)
---
## Q: PPT Master 支持哪些源文件格式?
几乎所有常见格式都支持:**PDF**、**DOCX**、**PPTX**、**EPUB**、**HTML**、**LaTeX**、**RST**、**网页链接**(包括微信公众号文章)、**Markdown**或者直接在对话中粘贴文字内容。AI 代理会自动将源材料转换为 Markdown 后再生成幻灯片。
## Q: 只有一个主题或想法、没有任何资料,也能生成吗?
可以。直接告诉 AI 你想做的主题或场景(如"做一个关于宫崎骏的 PPT"、"介绍我们公司新产品"AI 会自动启动 **topic-research 工作流**——通过网页搜索抓取权威来源Wikipedia / 官网 / 机构发布),整理成 Markdown 资料文档 + 配图集后再走主流程生成幻灯片。
效果取决于公开网页的覆盖度。如果你已有专业资料(论文、内部文档),直接把文件给 AI 比联网检索更准。
## Q: 除了 PPT 还能生成其他格式吗?
可以。除了标准的 **16:9****4:3** 演示文稿格式PPT Master 还内置了社交媒体和营销类格式:
| 格式 | 适用场景 |
|------|----------|
| 小红书 3:4 | 图文分享、知识帖 |
| 微信朋友圈 / IG 1:1 | 方形海报、品牌展示 |
| Story / 抖音 9:16 | 竖版故事、短视频封面 |
| 微信文章头图 | 公众号文章封面 |
| A4 印刷 | 印刷海报、传单 |
创建项目时指定格式即可(如 `--format xhs`)。输出仍然是包含原生形状的 `.pptx` 文件。
## Q: PPT Master 支持哪些 AI 工具?
PPT Master 可以在任何能读取文件和执行命令的 AI 编程代理中运行——**Claude Code**CLI / VS Code / JetBrains / Web、**VS Code Copilot**、**Codex** 等均可使用。不同工具的使用成本可参考下方的费用对比。
## Q: 能用 AI 生成配图吗?
可以。PPT Master 内置了图片生成脚本支持多个供应商Gemini、OpenAI、FLUX、通义千问、智谱等。在策略师阶段选择"AI 生图"方案后,流程会根据内容自动生成配图。你也可以使用自己的图片——只需放到项目的 `images/` 目录下即可。
## Q: 没有生图 API Key还能配图吗
可以——在策略师的"图片方案"步骤选择"网络图片"。PPT Master 内置了零配置的 `image_search.py`,在 Openverse 和 Wikimedia Commons 中搜索可商用的开放许可图片(无需 API Key。零配置搜索适合作为兜底能直接用但图片质量不稳定容易出现普通用户上传、构图随意、清晰度一般的素材。
如果想要更现代的商业风照片,建议在 `.env` 里设置 `PEXELS_API_KEY` 和/或 `PIXABAY_API_KEY`(都是免费申请)。搜索会自动纳入 Pexels / Pixabay人物、办公、生活方式、产品和插画类图片质量通常会明显更稳定。两种路径可以在同一份 deck 里混用(比如 hero 图用 AI 生成、团队照片用网络搜索如果选中的图片需要署名Executor 会在该幻灯片自动添加就地小字署名。
## Q: 生成的 PPT 可以编辑吗?
可以。主 `.pptx`(原生 PowerPoint 形状,文字、图形、颜色均可直接编辑,无需转换)以时间戳命名保存至 `exports/`。Executor 的原始 SVG 源(`svg_output/` 副本)始终镜像到 `backup/<timestamp>/svg_output/`,便于归档或基于该版重跑 `finalize_svg → svg_to_pptx` 重建 pptx无需再走 LLM。加 `--svg-snapshot` 会额外在 `exports/` 内并排生成 SVG 快照版 pptx便于跨平台单文件分发默认关闭——日常开发/诊断场景中 live preview 已经提供了 SVG 视觉参考。需要 **Office 2016** 或更高版本。
## Q: 为什么一段正文被拆成了好几个文本框?能不能一段一个文本框?
默认会把可合并的正文段落导出成一个可编辑的 PowerPoint 文本框,内部保留多个段落。**拉伸框时文字会在框内自动重排**。
如果你需要严格保持逐行版式,重新导出时加上 `--no-merge`
```bash
python3 skills/ppt-master/scripts/svg_to_pptx.py <project_path> --no-merge
```
使用 `--no-merge`SVG 里的每一视觉行都会变成一个独立的 PowerPoint 文本框。这样能**逐像素保留 SVG 的版式**,适合封面、图表、表格、以及任何对版式精度敏感的页面。
**代价**默认段落合并后PowerPoint 自动换行的行数可能与原 SVG 不一致。默认更适合正文密集型页面abstract、多段落章节、参考文献等版式敏感页面使用 `--no-merge`。判定足够保守——非段落型 `<text>` 会自动落回按行拆框路径。
跟 AI 对话时也可以直接说:"这个页面要严格保持逐行版式" —— AI 重新导出时会加上 `--no-merge`
## Q: 三种执行师有什么区别?
- **Executor_General**: 通用场景,灵活布局
- **Executor_Consultant**: 一般咨询,数据可视化
- **Executor_Consultant_Top**: 顶级咨询MBB 级5 大核心技巧
## Q: 用 PPT Master 做 PPT 贵吗?
PPT Master 本身免费开源,唯一的成本来自你自己的 AI 模型用量。
目前主流 AI 工具都已转向按量计费——用多少付多少。PPT Master 天然契合这一模型:不需要额外订阅 PPT 平台、没有专有积分、没有按人头收费的演示工具费用。
作为对比Gamma 订阅 $820/月Beautiful.ai $1245/月——无论用多少都得付这个底价。PPT Master 在你现有 AI 支出之外不增加任何额外成本。
## Q: 生成的图表可以编辑数据吗?
图表以**自定义设计的 SVG 图形**形式渲染,转换为原生 PowerPoint 形状——形状级别完全可编辑(移动、改色、改文字、调样式)。这是一个有意为之的选择,而不是 Excel 驱动的图表对象PowerPoint 默认图表样式陈旧、视觉受限于固定模板。SVG 图表则提供出版物级的视觉质量,并且可以在 PowerPoint 中直接精修。
如果你的工作流明确需要 Excel 驱动的数据编辑,可以在导出后自己手动在 PowerPoint 里制作一张类似的原生图表。
## Q: 页面切换和元素动画可以调吗?
可以。页间转场(默认 `fade` 0.4s)和页内元素入场动画(默认 `auto` 效果 + `after-previous` 自动级联,根据每个 group 的 SVG id 自动映射效果——图片类 id 在视觉池中循环以产生 deck 内变化)都通过 `svg_to_pptx.py` 的参数控制——`-t/--transition` 控制页级,`-a/--animation` 控制元素级。常用一行命令:
```bash
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t push # 换转场效果
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t none # 关闭转场
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -a none # 关闭页内动画
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation fade # 改用单一效果(仍是默认级联)
python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation-trigger on-click # 改为单击触发,演讲者控制节奏
```
`on-click` 适合现场演示。通过 `--recorded-narration` 做旁白/视频导出时会拒绝它,因为 PPT Master 只写页面级计时,不生成对象级点击计时;带旁白的 deck 请使用 `after-previous``with-previous`
完整效果列表、`<g id="...">` 锚点机制、降级行为、限制:见 [转场与动画](./animations.md)。
## Q: 推荐用什么 AI 模型?
**Claude**Opus / Sonnet是推荐且测试最充分的模型。SVG 排版本质上是在绝对坐标系中做精确的数学计算(字号 x 字数 x 容器宽度Claude 在这方面表现明显优于其他模型。
**GPT 系列**早期版本排版问题较多——文字超出容器、元素错位、坐标计算失误。较新的版本(如 GPT-5.5)在这方面已有明显进步,实际效果可以接受;如果遇到问题,可以告知 AI 修正具体页面。
其他模型Gemini、GLM、MiniMax 等)效果参差不齐。总体来说,前端/视觉能力越强的模型,生成效果越好。
## Q: 有人说 PPT Master "只是个玩具"——这个评价准确吗?
不准确。PPT Master 是一个 **harness**,不是完整的 agent——`harness + model = agent`,输出上限完全由模型决定,而不是由 harness 本身决定。用弱模型或小上下文窗口来评价 PPT Master就好比挂着一档开跑车然后说它跑不快。
**发挥完整实力的组合:**
- **Claude 大上下文窗口**(推荐 ~100 万 token 级别):大上下文让 Executor 在同一个会话里看到全部已生成页面,在不拆分运行的前提下保持整份 deck 的视觉一致性。上下文不足时被迫走拆分模式,两段之间会出现明显的风格漂移。
- **AI 生图,推荐 `gpt-image-2`**(或同等质量):配图水平是 deck 整体观感的最大变量。用占位级的网络图片和用真正贴合内容的 AI 生成图,视觉效果完全是两个量级。
如果你看到的效果差强人意,先对照以下几点检查你的配置,再下结论:用的什么模型?上下文开了多大?有没有接入图片生成 API同样的工作流Claude Opus 配 100 万 token 上下文配 `gpt-image-2` 的结果,和小参数开源模型配零配置的结果,是截然不同的体验。
**harness 决定工作流上限model 决定质量上限。** 如果 agent 能力不达预期,请先升级模型,再来评价 harness。
> **没有 Claude 渠道?** 本项目赞助商 [PackyCode](https://www.packyapi.com/register?aff=ppt-master) 提供 Claude 及其他主流模型的按量付费接入——无需订阅,无需境外信用卡,支持国内支付,开箱即用。充值时填写优惠码 **`ppt-master`** 享 9 折。
最后再说一句:这是一个免费、个人维护的开源项目。合用就用,能帮到你我很高兴;不合用,换个工具就好。真诚的反馈与建议始终欢迎——这也是项目一点点变好的方式。
## Q: 文字超出边框 / 元素错位怎么办?
这几乎都是模型能力问题,不是 PPT Master 的 bug。SVG 排版是纯手动绝对定位——模型必须准确计算坐标、字体度量和容器尺寸。
**解决办法**
1. 切换到 **Claude**Opus 或 Sonnet如果你用的是其他模型
2. 告诉 AI 哪一页有问题、具体是什么问题——它可以单独重新生成某一页
3. 直接打开 SVG 源文件,让 AI 修正坐标
4. 记住:生成的 PPTX 是**高质量起点**,不是最终成品——在 PowerPoint 中做少量调整是正常的
## Q: 生成一份 PPT 要多久?
一份典型的 1015 页 PPT 大约需要 **1020 分钟**(使用吞吐较快的模型)。生成流程是**故意串行的**(逐页生成),这样才能保持前后页面的视觉一致性——并行生成方案曾经测试过,结果是各画各的、缺乏整体观。
如果感觉生成很慢,检查一下模型的 token 吞吐速度。瓶颈通常在模型的输出速度,而不是脚本本身。
## Q: 长 PPT 一次生成会不会上下文爆掉?
默认推荐**一次性连续生成**——1015 页的 deck 在 200K 上下文窗口下完全够用跨页视觉一致性也最好Executor 看到前几页 SVG 后会主动对齐风格、字号、节奏)。
只有信号偏重的场景(页数 ≥ 18 / 源材料很厚 / 走过 topic-research 累积大量 web 抓取AI 才会在策略师阶段给出**两段式(拆分模式)**的可选提示:第一阶段(八项确认 + 图片获取)结束后停止当前对话;你新开聊天窗口,输入 `继续生成 projects/<项目名>` 进入第二阶段SVG 生成 + 导出)。新会话从磁盘重新加载 `design_spec` / `spec_lock` / `sources` / `images` 继续执行。
两段式是**折中方案**——付出约 6K tokens 的 SKILL.md 重读成本,换得 60200K 的 Phase A 噪声丢弃,并把节省下来的窗口空间用于 Phase B 主动重读 `sources/` 做内容增稠。**信号正常时不需要**,提示也不会出现;用户随时可以忽略提示,走默认连续模式。
## Q: 能在导出前预览或修正某一页吗?
可以。你可以**随时中断工作流**——前几页生成后就可以查看并反馈意见。AI 可以根据你的意见重新生成特定页面,不需要等到全部完成再修改。
生成后的修正也一样简单,直接告诉 AI"第 3 页布局有问题——标题和图表重叠了",它会修正那个特定的 SVG。
## Q: 我已经有一份做好的 `.pptx`,能不能复用它的设计、只填新内容?
可以——这就是 **套模板template fill** 路径,独立于 SVG 生成管线。把你现成的 `.pptx` 连同素材(或一个主题)给 AI说「套模板 / 把这些填回去」。它会把你的 deck 当作原生页面库,只挑适合新内容的页面(可乱序、可重复),把新文字——以及原生表格单元格、图表数据——直接写回原始 OOXML。
输出仍是 100% 原生可编辑的 PowerPoint原设计、母版、图片、动画都保留且只导出选中的页面。它刻意**不**改版式、不加页、不换图——一份 deck 的页面结构本身承载着逻辑(总分、对比、递进),所以应挑选结构本就契合内容的页面,而不是硬塞进去。若需要全新结构或不同页数,请改用 create-template见下一问。完整步骤[套模板工作流](../../skills/ppt-master/workflows/template-fill-pptx.md)。
---
## Q: 如何制作自定义模板?
想把自己喜欢的 PPT 模板制作成 PPT Master 可调用的模板?按以下步骤操作:
**第一步 — 准备参考材料**
**最推荐的方式是直接给原始 `.pptx` 文件**。当前的 PPTX 导入管线能做到接近高保真还原——PPT Master 会从 PPTX 中提取主题色、字体、母版/版式结构、可复用图片资源(包括精灵图裁剪关系),再用这些素材重建出干净可维护的模板。封面、章节、装饰繁复的页面都能稳定还原,这是目前最靠谱的派生路径。
没有源 PPTX 时,截图集也能跑(`cover.png` / `toc.png` / `chapter.png` / `content.png` / `closing.png`),但保真度会明显下降。建议优先找原始 PPTX。
**第二步 — 让 AI 创建模板**
使用 AI 编程代理Claude Code、Codex 等),要求它使用 **PPT Master 的 `/create-template` 工作流**,将这些参考材料转换成模板。提供的信息越详细,效果越好,例如:
- 模板名称和适用场景(如政府汇报、高端咨询、产品宣讲等)
- 期望的风格基调和配色(如"现代克制、深蓝主色调"
- 类别偏好(`brand` 品牌 / `general` 通用 / `scenario` 场景 / `government` 政务 / `special` 特殊)
- 画布格式(默认 16:9如需其他格式请注明
不需要一次提供所有细节——AI 代理会通过对话追问补齐缺失信息(模板 ID、主题模式等
**第三步 — 等待完成**
AI 代理会自动完成后续工作 — 分析截图、构建布局定义、注册模板,使其出现在 PPT Master 工作流的模板选项中。
> **提示**:对风格和使用场景描述得越具体,生成的模板就越符合你的预期。
---
> 更多问题可先查看 [skills/ppt-master/SKILL.md](../../skills/ppt-master/SKILL.md) 与 [AGENTS.md](../../AGENTS.md)