news 2026/9/7 9:19:37

PPT Master 实践 FAQ 全解:源格式、原生导出、图表公式与模板复用的完整技术指南

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
PPT Master 实践 FAQ 全解:源格式、原生导出、图表公式与模板复用的完整技术指南

PPT Master 实践 FAQ 全解:源格式、原生导出、图表公式与模板复用的完整技术指南

【免费下载链接】ppt-masterAI turns documents or topics into real, native PowerPoint decks—with native shapes, transitions and animations,>项目地址: https://gitcode.com/GitHub_Trending/ppt/ppt-master

本文基于仓库内官方 FAQ(docs/faq.md)逐题展开,并结合skills/ppt-master/scripts/下的转换脚本、CLI 参数定义与工作流文档做源码级印证。读完本篇,你将掌握 PPT Master 的输入格式边界、更新与轻量部署路径、图片获取策略、多行文本重排与 px→pt 导出机制、原生图表/公式/超链接/动画的开关方式,以及复用已有 PPT 的三条路由决策方法。

一、输入与生成路由

1.1 支持哪些源格式?

几乎覆盖所有常见文档形态:PDF、DOCX、PPTX、EPUB、HTML、LaTeX、RST、URL(包括微信文章)、Markdown,甚至直接粘贴进对话的纯文本。AI Agent 会先将源材料自动转换为 Markdown,再生成幻灯片。

1.2 没有素材、只给主题也能生成

可以。直接向 AI 说明主题或场景(例如"做一份关于宫崎骏的 PPT"、"介绍我们的新产品"),Generate PPTX 路由会执行其topic-research 阶段,收集规划所需的事实基线与来源溯源(provenance)。细节边界如下:

  • 若你提供了部分素材,同一阶段通常只补齐结果所需的事实缺口,除非你明确要求"仅基于源材料"的产出;
  • 项目导入时不会批量抓取溯源中记录的已采纳网页 URL;
  • 常规图片搜索失败后,至多抓取一个相关页面及其配套图片供审阅,且只有被选中的文件才会进入幻灯片的图片池。

质量取决于公开网络上有什么。如果你已有专业材料(论文、内部文档),直接把这些文件交给 AI,效果通常优于纯网络调研。

1.3 除 16:9 和 4:3 外还支持哪些画布格式?

除标准16:94:3演示格式外,PPT Master 开箱即支持社媒与营销画布:

格式典型用途
小红书 (RED) 3:4图文分享、知识帖
朋友圈 / IG 1:1方形海报、品牌展示
Story / TikTok 9:16竖版故事、短视频封面
微信公众号头图公众号封面图
A4 打印打印海报、传单

开项目时直接指定格式即可(例如--format xhs)。从 画布格式注册表 可以看到wechat(3:4)、9:16 竖版、a4等格式均登记在CANVAS_FORMATS中,导出时 svg_to_pptx 的-f/--format参数会强制要求 SVG 画布与该注册格式匹配。输出仍然是一个包含原生形状的.pptx文件。

1.4 兼容哪些 AI 工具?

任何"具备 Agent 能力、能读文件、能执行 shell 命令"的 AI 工具都可以运行 PPT Master——Claude Code(CLI / VS Code / JetBrains / Web)、VS Code CopilotCodex等。

二、安装、更新与轻量部署

2.1 旧版本如何更新到最新?

取决于安装方式:

安装方式更新方式
Git cloneppt-master目录下运行python3 skills/ppt-master/scripts/update_repo.py
下载 ZIP下载最新 ZIP,解压到新文件夹,把旧目录的.envprojects/拷入新目录,再运行pip install -r requirements.txt
Skill 市场通过对应的 marketplace / skills 工具重新安装或更新

长期使用推荐 Git clone;ZIP 适合快速试用,但它没有 Git 历史,无法执行git pull

不确定自己属于哪种安装方式时,在项目目录里直接让 AI 执行 更新脚本:

python3 skills/ppt-master/scripts/update_repo.py

如果该目录不是 Git clone,脚本会告诉你对应的 ZIP 安装该如何迁移。

2.2 仓库超过 1 GB,技能工具下载失败,能只装 skill 吗?

能。完整仓库偏大(Git 历史 + 捆绑的示例 deck 及其素材),且体积已经固化在历史里——在不破坏众多现有 fork 的前提下无法裁剪。如果只要 skill 本体,有两条轻量路径:

  • Marketplace CLInpx skills add hugohe3/ppt-master,或 Claude Code 的/plugin install,只拉取 skill 文件;
  • 手动下载:从项目 Releases 页获取ppt-master-skill-*.zip(仅 skill 文件,约 56 MB),无需完整 clone。

无论哪条路径,都要在安装位置执行pip install -r requirements.txt,让后处理脚本可用。

由于两条路径都不带.git目录,git describe无法报告版本;所安装的版本记录在 skill 自身 SKILL.md frontmatter 的metadata.version字段中。

三、图片策略:AI 生成、网络搜图与手动换图

3.1 能用 AI 生成的图片吗?

能。当 Agent 宿主提供原生图像工具时,PPT Master 可以直接使用它,无需另行配置图像生成 API key;也可以通过内置的 image_gen.py 走已配置的 provider。在图片方式中选择 "AI generation",也可以明确要求 Agent 使用其自带图像工具。另外,你可以把自己的图片放进项目的images/目录。

3.2 没有图像生成 API key 还能拿到图吗?

能。若 Agent 宿主有原生图像生成能力,选 "AI generation" 并让它用自己的图像工具即可——不需要 provider 的图像 API key。否则在 Strategist 的 Image Usage 步骤选择 "Web-sourced":PPT Master 附带了一个零配置的 image_search.py,在 Openverse 与 Wikimedia Commons 上搜索开放许可图片。

零配置搜索的定位是兜底:立即可用,但质量参差不齐,因为很多结果是普通用户上传。

想要更好的当代图库照片,在.env中设置PEXELS_API_KEY和/或PIXABAY_API_KEY(两者都免费),搜索会自动包含 Pexels / Pixabay,人物、职场、生活方式、产品与插画类图片质量通常更好。一份 deck 内可以混用路径(例如 AI 出主视觉插画、网络图出团队照)。若某张入选图片需要署名,Executor 会在受影响页面上加一行小的内联 credit。

FAQ 特别强调了对网络搜图的清醒预期:搜索只能找到"一张"相关、可下载、许可干净图,不保证它好看或适合该页,因为排序看到的是文本元数据而非画面本身。生成过程中多模态模型会读取缩略图做合理性检查,对不合适的结果重新发起查询;但最可靠的提质路径是手动挑图——你在任何地方找到更好的图,把 URL 交给 AI,它会通过image_search.py --from-url <url>下载并替换(记录为手动来源,版权需自行核实)。替换可以在生成中途或实时预览时发生,无需停止运行。一句话:把网络搜索当占位兜底,把手动挑图当抛光步骤。

四、Image to PPTX:把 AI 生成的 mockup 或截图重建成可编辑幻灯片

提供一张或多张图片,并要求"把图中页面重建成可编辑 PPTX",PPT Master 会路由到Image to PPTX(image-to-pptx)profile。该 profile 目前要求 Codex——其他 Agent 宿主尚未适配,行为不受支持也不作承诺。它始终自动激活 Quick,无需单独要求。流程与规则要点:

  • 先把所有输入归一化为一个有序页面帧名册(page-frame roster),因此页数跟随"被表示的页面数"而非文件数;
  • 普通可见文本重建为原生可编辑文本
  • Logo、图标、徽章、装饰图形:源素材足够时直接采用;分辨率过低时 Codex 可以基于参考重建,但身份、轮廓、比例、颜色与字标必须固定,禁止"神似"替代;
  • 图表、表格、数据图形绝不生成式重建:它们必须是数值可验证的原生对象、精确源素材,或标记为manual_required
  • 照片与插画场景重建为"至少一个干净底层 + 主体/前景层";多个不重叠、带 padding 边界框的对象可共用一张生成底版,再通过网格切分或 SVG 边界框裁剪变成相互独立的 PowerPoint 图片对象;
  • AI 可以重建被分离图层遮挡的像素,但不得重新设计可见构图;"整页截图皮肤 + 少量可编辑 token 叠加"不算重建。

五、原生可编辑性与导出机制

5.1 生成的演示文稿可编辑吗?

可以。SVG 管线中唯一的 PPTX 转换器就是 PPT Master 自己的svg_output/→ DrawingML 转换,它把带时间戳的原生 PowerPoint deck 存入exports/,文本、图形、颜色都可以直接作为 PowerPoint 对象编辑。在默认输出路径下,Default Generate 与 Quick Generate 都会把创作期svg_output/拷贝到backup/<timestamp>/svg_output/,因此同一份创作 deck 可以不重跑 LLM地重新导出;对 Quick 而言这是包的重建,而不是可恢复的 AI 设计决策记录。

finalize_svg.py 在默认 Generate 流程中仍是必做的 Step 7——尽管原生 PPTX 导出读的是svg_output/。它产出svg_final/中的自包含文件,供视觉检查,也供手动以 SVG 图片形式插入其他 deck。显式 quick-generate profile 跳过该预览产物,但仍保留正常 postflight 报告与默认路径备份(在其无锁最终质量检查之后)。PowerPoint 手工的Convert to Shape不是受支持的往返路径;需要可编辑形状时请使用生成的原生 PPTX。

5.2 多行文本如何导出?PowerPoint 会重排吗?

默认行为:可合并的多行块导出为一个可编辑的 PowerPoint 文本框。创作期换行被保留,PowerPoint 自动换行被禁用,因此拉伸文本框不会改写你排好的行布局。普通生成框使用 PowerPoint 原生的Resize shape to fit text行为:删除保留的换行时,文本框会扩展而不是把文本甩到框外。导入的精确框与结构化多行占位符载体则保留固定尺寸行为。

从源码看,这一行为由 svg_to_pptx 的 CLI 中一个互斥参数组控制,--reflow-text--merge-paragraphs(兼容别名)、--no-merge三选一,默认值为保留(PRESERVE)模式:

  • 想让 PowerPoint 对合格正文自动重排(可能改变行数):
python3 skills/ppt-master/scripts/svg_to_pptx.py <project_path> --reflow-text

旧参数--merge-paragraphs--reflow-text的兼容别名。

  • 只有当"每一条视觉行都必须是独立 PowerPoint 文本框"时才用--no-merge
python3 skills/ppt-master/scripts/svg_to_pptx.py <project_path> --no-merge

该模式保留逐行独立对象定位,但一段 12 行的文字会变成 12 个文本框。

与 AI 对话时,说"自动文本重排"或"每条视觉行一个独立文本框"即可选择对应导出模式。

5.3 为什么字号是 px 不是 pt?导出会变吗?

PPT Master端到端使用无单位 px——确认页、spec_lock.md与 SVG 全部是 px,没有 pt 层。SVG 画布就是 1280×720 px,px 是真实的布局/执行单位;单一单位避免了"确认为 20pt 但写进 SVG 时变成另一个数字"的尺寸漂移。

PowerPoint 显示 pt,因此导出时自动把 px 转 ptpt = px × 0.75,保留一位小数)。这一换算在转换器工具中是硬编码常量:drawingml/utils.py 中FONT_PX_TO_HUNDREDTHS_PT = 75 # 1px = 0.75pt -> 75 hundredths-of-a-point。例如24px正文变18pt42px标题变31.5pt。所以 PowerPoint 里出现的13.5pt31.5pt这类非整数值是预期且刻意的,不是 bug——字号就是 px 折算出来的值,不再被强制对齐到整点或半点。

正文基线是按阅读模式(reading mode)取定的固定值(不是区间),控制阅读距离与密度;它与不设上限的沟通意图相互独立:

阅读模式正文 px≈ 导出 pt
text(近读:报告 / leave-behind)20px15pt
balanced(默认:路演 / 评审)24px18pt
presentation(投屏 / 发布会)32px24pt

标题、副标题、脚注等其余角色按正文比例推导,并吸附到整洁的偶数 px。确认页上可以覆盖任意角色的 px 值。

六、风格如何决策:Mode × Visual Style

两个相互独立的选择,在确认点d处锁定:

  • Mode(deck 如何论证)pyramid/narrative/instructional/showcase/briefing——参考references/modes/目录;
  • Visual style(看起来什么样)swiss-minimal/editorial/soft-rounded/dark-tech… 外加custom——参考references/visual-styles/目录。

任意 mode 可搭配任意视觉风格。

七、成本与模型选择

7.1 使用 PPT Master 贵吗?

PPT Master 本身免费且开源,唯一成本是你自己的 AI 模型用量。行业内的 AI 工具普遍转向按用量计费——为实际消耗付费。PPT Master 天然适配这一模式:没有额外的 PPT 订阅、没有专有积分、没有按席位收费的演示平台层。由于它运行在 coding agent 内,按包月订阅的计划可以零额外单份成本地产出多份 deck;按 token 直连 API 只是另一种价格结构——由你选择。无论如何,PPT Master 不会在你的 AI 开销之上叠加任何自己的费用。

7.2 哪个 AI 模型效果最好?

Claude(Opus / Sonnet)是推荐且测试最充分的模型。SVG 布局需要精确的绝对坐标计算(字号 × 字符数 × 容器宽度),Claude 在这类任务上的表现显著优于多数替代方案。

GPT 系列旧版本更容易出现布局问题——文本溢出容器、元素错位、坐标算错;较新版本(如 GPT-5.5)有明显改善,实际可用,出问题就告诉 AI 修哪一页。

其他模型(Gemini、GLM、MiniMax 等)质量不一,总体规律是:前端/视觉能力越强的模型结果越好。

7.3 "PPT Master 只是个玩具"这个说法公平吗?

不公平。PPT Master 是一条演示工作流,不是模型,也不是完整 Agent。它提供演示专用的推理、契约、项目状态、确定性转换与质量门;所选模型仍然决定质量上限。用弱模型或短上下文模型评测这条工作流,相当于挂着一档试跑跑车然后得出结论"它很慢"。

满配组合

  • 大上下文窗口的 Claude(理想约 1M tokens):大窗口让 Executor 在同一会话里看到此前生成的每一页,全程无需分次运行即可维持整套 deck 的视觉一致性。小窗口被迫进入分段执行(split mode),阶段之间会出现可见的风格漂移。
  • gpt-image-2(或同级)AI 图像生成:占位级的图库图是 deck 显得平庸的第一大原因;换成贴合品牌的 AI 生成插画,观感会立刻改观。

如果你看到的结果平庸,先检查自己的配置再下结论:什么模型?多大上下文?开了图像生成吗?"PPT Master + Claude Opus(1M 上下文)+ gpt-image-2 图片"与"PPT Master + 小型开源模型 + 未配置图像 API"是完全不同的体验。

八、原生对象:图表、公式与超链接

8.1 生成的 PPTX 中图表可编辑吗?

默认情况下,图表渲染为自定义设计的 SVG 图形再转换为原生 PowerPoint 形状——作为形状完全可编辑(移动、改色、改字、改样式)。这是刻意选择,而非 Excel 驱动的图表对象:PowerPoint 默认图表观感通用且过时,还会把 deck 锁死在僵硬模板里。SVG 图表给你可直接在 PowerPoint 中微调的出版级视觉,并在 PowerPoint / Keynote / LibreOffice / WPS 间像素级一致地渲染。

如果你的工作流确实需要 Excel 驱动的数据编辑或 PowerPoint 图表/表格专用控件,用--native-charts-and-tables导出:受支持的数据图表与纯文本网格表格会作为带数据支撑的 PowerPoint 原生 Chart / Table 对象输出(保存为exports/<name>_<timestamp>_native_charts_tables.pptx,保留 deck 自身配色而非 PowerPoint 默认主题)。该开关定义于 svg_to_pptx CLI。默认的 SVG 回退路径同样导出为可编辑 DrawingML 形状,但不带图表数据工作簿或表格/图表对象模型。原生对象在 PowerPoint / Keynote / LibreOffice / WPS 之间可能有细微视觉差异,因此形状路线仍是视觉稳定性默认值。

8.2 公式可编辑吗?

在 PowerPoint 中可以。PPT Master 把独立块级公式与同段落内联公式都导出为可编辑的 OMML,而不是截图或图片资产:块级公式用 formula group,内联公式用普通文本 run 之间的叶子节点<tspan>python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t push # 换一种过渡 python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -t none # 关闭过渡 python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -a auto # 启用逐元素入场(效果由分组 id 映射) python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation entrance_fade # 用单一规范效果启用 python3 skills/ppt-master/scripts/svg_to_pptx.py <project> --animation emphasis_spin # 原生强调效果 python3 skills/ppt-master/scripts/pptx_animations.py --list # 完整分类效果清单 python3 skills/ppt-master/scripts/svg_to_pptx.py <project> -a auto --animation-trigger on-click # 演讲者手动节奏揭示

on-click面向现场演讲。通过--recorded-narration的旁白/视频导出会拒绝on-click,因为 PPT Master 写入的是页面时序而非对象级点击时序;旁白 deck 请使用after-previouswith-previous。常用命令、Start 模式指引与对象级定制见 Animations & Transitions,完整效果与校验行为以该执行参考为准(效果清单可由 pptx_animations.py 列出)。

十、质量排障、生成时长与上下文管理

10.1 文字溢出或元素错位怎么办?

先定位错位出现在哪一层:如果源 SVG 本身就溢出或错位,通常是创作/布局问题——模型必须正确计算坐标、字体度量与容器尺寸;如果 SVG 预览正确而导出 PPTX 不同,那可能是转换器或渲染器 bug,应同时附上两份产物上报。

可尝试的修复

  1. 对比svg_output/中的该页与导出的 PPTX,隔离"创作问题"与"转换问题";
  2. 告诉 AI 具体哪页有问题并描述现象——它可以只重生成个别页;
  3. 如果 SVG 本身反复出错,换更强的模型,或直接让 AI 修正坐标;
  4. 记住:生成的 PPTX 是高质量可编辑草稿,不是密封的最终交付物——在 PowerPoint 中做轻微收尾调整是预期内的。

10.2 生成一份演示文稿要多久?

典型 10–15 页的演示文稿在快速模型上大约10–20 分钟。生成是刻意串行的(一次一页),以维持跨页视觉一致性——并行生成被测试过,会产生风格不一致。

如果感觉慢,先检查模型的 token 吞吐。瓶颈通常在模型输出速度,而不是脚本。

10.3 长 deck 会不会一次打爆上下文窗口?

默认推荐:连续一次性生成。10–15 页的 deck 在 200K 窗口内很从容,而且当 Executor 能在同一会话看到前序页面时,跨页视觉一致性最好(它会主动对齐风格、字号与节奏)。

当当前 AI 编辑器支持隔离的研究 worker 时,topic-research会把原始抓取留在那里,主对话只读取保存的研究补充与事实溯源文件。

只有当信号偏重(≥ 18 页、源材料厚重、或本地回退/异常大的导入补充之后主对话仍留有大量研究材料)时,AI 才会在 Strategist 阶段给出**可选的分段模式(split mode)**提示:规划会话(Strategist 确认 + 图片获取)在当前对话收尾;你开一个新聊天窗口,输入resume execution projects/<project_name>进入执行会话(SVG 生成 + 导出)。新会话从磁盘重新加载design_spec/spec_lock/sources/images并继续。

分段模式是一种折中——新会话要支付重新加载 Generate 权威文档与必需执行参考的固定成本,但丢掉了规划会话的噪声,并把腾出的预算用于重读sources/以获得更丰富的页面内容。信号正常时不需要:提示不会出现,你随时可以无视提示留在连续模式。

10.4 整页导出前能预览或修单页吗?

能。你可以在任何时刻打断工作流——前几页生成后审阅并给反馈,AI 可以根据你的评论重生成指定页面,不必等到最后再修正。生成后修复也一样:直接告诉 AI "第 3 页有布局问题——标题压住了图表",它会修对应的 SVG。

十一、跳过设计确认:Quick Generate

不想先确认设计规格、想直接生成?显式要求 quick generation,Generate 路由会使用 quick-generate profile。

它跳过的是:Strategist 分析、design_spec.md/spec_lock.md产物、以及分阶段确认停顿——你显式说出的部分被遵循,未指定的部分由当前 Agent 直接决定并继续,不再回来征求批准。什么都不说,Agent 就决定一切。它同时跳过finalize_svg.py,因此 Quick 不产生svg_final/预览。

它不跳过准备与设计能力。源转换、针对已识别事实缺口的调研、共享审美参考、deck 所需的一切资源在需要时仍然执行:提供或提取的图片、AI/网络/切片图片、项目图标、原生形状、图表/表格,以及必需的操作 manifest 或溯源记录。公式直接在受影响的 SVG 中写为 PowerPoint 原生标记,而不是准备成图片资产。若必需素材未就绪,流程仍会停下来向你索要,而不是拿不相关材料顶替。准备完成后,当前 Agent 按共享标准手写svg_output/,跑无锁的 Quick 最终质量检查器,修完所有阻断性错误后才导出最终 PPTX。

普通导出器能力按需保留,包括原生图表/表格替换、备注、动效、旁白与诊断;备注、自定义对象动画与旁白默认关闭,Agent 可在请求或 deck 需要时直接启用,无需打开确认流程。默认路径导出会写正常 postflight 报告并把svg_output/快照到backup/;显式输出路径保持普通的无备份行为。页数本身既不会激活也不会阻止 quick generation。

由于整个规划阶段不再发生,token 用量显著低于默认流程;而逐页 SVG 创作是一次运行中的主导成本,且不会缩水。Quick 保持同样的页级视觉与资源创作能力、同样的共享 SVG/资源阻断标准;它不跑 Spec Lock 对齐检查,其包保留转换器默认 Theme 脚手架,而不是从 lock 推导 Theme 颜色、字体与 Master 标题/正文尺寸默认值。由于没有确认过的设计契约、首页校准或可恢复的决策历史,它不承诺与 Default 相同的设计决策或墙钟时间。

十二、复用已有 PPT:路由决策与模板体系

12.1 已有 PPT 想在其基础上做——选哪条路由?

把"使用已有 PPT"拆成两个问题:保留内容还是不要保留设计(布局 + 视觉)还是不要。四种组合对应三条生成路径加一个"保持原样"选项:

意图路由固定不变的部分
保留内容 + 重做布局Generate PPTX + beautify profile页数、页序、每页文案、图表/表格数据
替换内容 + 保留设计Fill Native PPTX原生源幻灯片设计;选定页可复用/重排
只保留内容,重做设计与分页Generate PPTX源事实;故事结构与页数可变
内容 + 设计都保留无需生成直接用原文件

源 deck 的分页本身属于交付物时用beautify profile:文本逐字保留,页数与页序 1:1 保持,只重做布局/层级/留白,并继承原配色/字体。说法示例:"让这份 deck 更好看" / "重新排版这个,保留文案"。见 beautify profile。

源 PPT 只是素材时用主管线:用ppt_to_md抽成 Markdown,从analysis/读取 PPTX intake 事实,再让 Strategist 自由重构大纲(合并/拆分/重排页面)。说法示例:"用这份的内容做一份更好的 deck"或"把它变成一份 10 页的高管简报"。

beautify 与主管线之间的一行判别标准:源的分页是需要保留的信息,还是只是上一位作者可改进的结构?保留 → beautify;改进 → 主管线。具体判据是页数/页序:只要它发生任何变化——拆、合、删、重排,甚至一字不改但把一页拥挤页拆成两页以便阅读——那就是重分页,属于主管线。Beautify 严格 1:1。

若请求含糊(例如"让这份 PPT 更专业"或"优化这份 deck"),AI 应路由前问清一句:保留原始页数/页序与每页文案,还是把 PPT 当源材料重构为新故事?

另有一条正交路线:现在不想产出 deck,但想把设计沉淀为可复用模板——用create-template(见 12.4)。

12.2 已有成品.pptx,只复用设计、填入新内容?

可以——这是**模板填充(template fill)**路由,独立于 SVG 生成管线。把你的.pptx与素材(或主题)交给 AI,说"用新内容填充这份 deck"或"填回这个模板"。它把你的 deck 当作原生幻灯片库:你可以只挑选契合新故事的页(自由重排,一页可服务多个输出页),然后把新文本——以及原生表格单元格与图表数据——直接写回原始 OOXML。

输出保持 100% 原生可编辑:原设计、版式、图片、动画全部保留,只导出选定页。它刻意改版式、不加页、不换图——一份 deck 的页面结构编码了它的逻辑(先总后分、对比、递进),因此应挑选结构本来就契合内容的页面,而不是硬塞。要全新结构或不同页数,改用 create-template(下一节)。完整步骤见 template-fill workflow。

12.3 内容落到了意外位置——如何查看 PPT Master 检测到了什么?

两条消费 PPTX 的路由在生成任何内容前都会写一份只读分析报告,读它就能看到精确识别了哪些形状。

Fill Native PPTX使用:

python3 skills/ppt-master/scripts/pptx_intake.py <deck.pptx> -o <analysis_dir>

<stem>.slide_library.json列出每页所有可填充槽位(含几何、段落数、文本度量),以及独立的tablescharts节。带样式的普通文本框也算槽位——形状不必是真正的 placeholder 才可填充。

Create Template使用:

python3 skills/ppt-master/scripts/pptx_template_import.py <deck.pptx> --manifest-only -o <workspace>

manifest.json 按页报告版式与母版路径、占位符(typeidxsemanticRoleshapeName)、图片资产、文本计数与页面类型;native_structure.json补充源结构评估。--manifest-only跳过 SVG 导出,因此"只看不做"时运行成本很低。

注意 Create Template 产出的是可复用模板工作区,不是填好的 deck:后续页面由 Generate 新创作,因此源文件的正文文案与演讲者备注刻意带到新页上。如果你预期可用的形状在这些报告中缺失,那就把它写进 issue。

12.4 如何创建自定义模板?

想把喜欢的 PPT 变成 PPT Master 的可复用模板?分三步:

Step 1 — 准备参考材料

推荐输入是原始.pptx。PPT Master 会提取主题身份、声明的 Master/Layout 拓扑、占位符元数据、原生形状证据,以及实际存在且受支持的复用资产。standardfidelity以源为视觉参考,创作新的 SVG 名册加新的 Master/Layout/槽位系统——既不保留也不蒸馏源拓扑;mirror则把已验证的源事实直接物化进新工作区,不做语义综合或缺口填补。固定的 Master/Layout 分组包装器会被机械展开为直接原子,因为结构层不能是<g>

大型导入 SVG 可能携带原生形状元数据、隐藏载体与预览指纹;该无损表示作为 payload 支撑保持在临时分析工作区中不可变。模板创作使用带文档本地源引用与紧凑 path/hash manifest 的轻量可编辑 IR。standard/fidelity创作项目规范 SVG,并仅对精确注册的 preset 匹配使用紧凑创作 preset 组。Mirror 从 IR 物化最终模板,仅对未变化的 Slide 本地/槽位引用复用转换器支持的 payload,对不支持或被编辑过的对象保留 SVG 回退。

没有源 PPTX 时,关键页类型的截图也能工作——封面、目录、章节、内容、结尾——但几何、字体与继承必须靠视觉推断。这条路径提取的是可复用模板系统;若期望产物是"每个被表示页帧一张分层可编辑幻灯片",请改用 Image to PPTX(image-to-pptx)。

Step 2 — 让 AI 创建模板

用任意具备 Agent 能力的 AI 工具(Claude Code、Codex 等),要求它使用 PPT Master 的/create-template工作流(create-template)把参考材料转成模板。给得越具体越好:

  • 模板名称与目标用途(如政府报告、高端咨询);
  • 期望语气与配色(如"现代克制、深蓝为主");
  • 类别偏好(brand/general/scenario/government/special);
  • 画布格式(非默认 16:9 时);
  • 输出范围:带索引的library(默认)或一个已初始化的project;两者使用相同的工作区路由,并省略空的可选资产目录。

不必一次给全细节——AI Agent 会对缺失项(输出范围、模板 ID、主题模式等)追问。

Step 3 — 等待结果

AI Agent 负责其余步骤:分析参考、编写按类别的规格、仅为 Layout/Deck 构建结构化布局定义、校验工作区。Brand/Style 永不创建预览 PPTX;Layout/Deck 按需生成exports/<id>_template_preview.pptx,多 Master 时必需。两种范围都要求templates/;Brand/Layout/Deck 可用包内images/icons/,Style 只含templates/design_spec.md。Library 范围写入skills/ppt-master/templates/<kind>/<id>/并注册;project 范围写入projects/<name>/并跳过注册。空可选目录被省略。兼容的 legacy-flat Brand/Layout/Deck 工作区仅在满足当前 kind 契约时保持可读;Layout/Deck 还要求当前结构化 SVGs。Style 没有 legacy-flat 形态,semantic-legacy 包必须通过create-template替换而非就地升级。

提示:风格与用途说得越具体,生成的模板越贴合你的预期。

结语:延伸阅读入口

本文按 FAQ 的问题边界重组了 PPT Master 的常见技术疑问,并用仓库源码印证了关键结论:文本重排的互斥 CLI 组(cli.py)、px→pt 的 0.75 换算常量(utils.py)、--native-charts-and-tables开关定义(cli.py),以及各脚本与工作流文档的真实落点。进一步深入时建议按主题跳转:能力与边界的逐特性记录见 PowerPoint ↔ SVG 映射指南;动画细节见 Animations & Transitions;完整技能契约见 SKILL.md;仓库协作约定见 AGENTS.md;真实生成效果可直接翻阅 examples 目录。

【免费下载链接】ppt-masterAI turns documents or topics into real, native PowerPoint decks—with native shapes, transitions and animations,>项目地址: https://gitcode.com/GitHub_Trending/ppt/ppt-master

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/7 9:17:39

毕业论文降重与润色:从传统方法到智能工具的进阶之路

1. 引言&#xff1a;论文修改的十字路口 毕业论文提交前夕&#xff0c;几乎每一位毕业生都会面临同一个难题&#xff1a;如何在不改变学术原意的前提下&#xff0c;让论文表达更精炼、结构更清晰、查重结果更理想&#xff1f;面对琳琅满目的修改方式&#xff0c;我和身边的同学…

作者头像 李华
网站建设 2026/9/7 9:17:12

KVM虚拟化实战:从零到一创建你的第一台虚拟机

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/7 9:17:08

CodexBar 语言切换指南:不碰系统设置,3 步把界面切成中文

CodexBar 语言切换指南&#xff1a;不碰系统设置&#xff0c;3 步把界面切成中文 【免费下载链接】CodexBar Show usage stats for OpenAI Codex and Claude Code, without having to login. 项目地址: https://gitcode.com/GitHub_Trending/co/CodexBar 刚装完 CodexBa…

作者头像 李华
网站建设 2026/9/7 9:09:06

语音降噪算法嵌入式移植实战:从MATLAB原型到真机

简介&#xff1a;面向音频处理与实时通信开发者的语音降噪算法工程包&#xff0c;基于 Speex 库实现噪声抑制功能&#xff0c;能够从交通、风噪等复杂环境中提取清晰人声&#xff0c;适用于电话会议、远程教育、语音识别等场景&#xff0c;也适合需要在嵌入式或移动平台集成降噪…

作者头像 李华