破译组会 PPT 的「提纲+模板 DNA」:scholar-ppt-cn 让 ChatGPT 5 分钟出一份可编辑的学术汇报
提纲决定讲述顺序,版式库决定页面结构,模板 DNA 决定视觉风格——学术 PPT 的本质,是「讲故事」而不是「拼模板」。
如果你经历过:开题答辩前一晚还在调 PPT 母版、组会前 30 分钟还在把论文里的 Figure 抠下来往 PPT 里塞、答辩完被导师吐槽”你这页文字太多,公式都看不清”——那么 scholar-ppt-cn 可能是你等了很久的那款工具。
它不是一个 AI 模板网站,而是一套塞进 ChatGPT / Codex 里的「中文学术 PPT 工作流 Skill」。作者 deathcats4 在仓库里塞了 19 份 references 规则文件 + 1 份 5 页参考模板,把”从论文到可编辑组会 PPT”这件事拆成了 5 步:生产规划表 → Mockup family + variants 蓝图 → 样板页 → 可编辑 PPTX 重建 → montage QA。
本文把它的核心理念、五步流程、4 类场景、横向对比全部拆给你看。文末附完整安装与使用教程。

一、组会 PPT 的”千年老问题”
学术 PPT 和商务 PPT 完全是两个物种。商务 PPT 是”说服”,学术 PPT 是”让评审老师沿清晰的思路快速了解你的研究内容”——来自清华大学《学术 PPT 教程》的定义。
这就带来几个独特难题:
论文里 Figure 多、公式多、参考文献多,每一页都得是图+解读+引用的混合体,不能纯文字
中文字体、字号、行距都有「学术规矩」(行间距 1.2 倍、字间距 1 磅、段前 6 磅),套了商务模板就翻车
答辩 PPT 和文献精读 PPT 的叙事逻辑完全不同:前者要”问题-方法-结果-贡献”四段式,后者要”作者做了什么-怎么做的-为什么这么做-我学到什么”
评审老师会在意逻辑完整度:背景→现状→研究空白→方法→结果→讨论→结论,每一环都不能缺
而市面上的 AI PPT 工具(Gamma、Tome、NotebookLM、必优、讯飞智文……)几乎都是为商务场景设计的:
风格偏 marketing,套到学术汇报上立刻”非主流”
输出的 PPTX 文字不能逐项编辑,二次修改成本极高
完全没有”提纲逻辑”层面的规划,论文给过去直接”翻译”成 PPT,逻辑全丢
scholar-ppt-cn 正是为了解决这一组问题而生的。
二、它提出了一个关键概念:模板 DNA
scholar-ppt-cn 在文档中反复强调 4 句话,请把它们刻进脑子里:
提纲决定讲述顺序; 详细版式库决定页面结构; 模板 DNA 决定视觉风格; image model 或 Python 负责生成。
最后一句是”工具”,前三句是”方法论”。这是它和所有”AI 一键生成 PPT”工具的最大区别。

模板 DNA 是什么? 它是一个 PPT 文件里那些”抽象出来还能用”的元素:
16:9 画布、页边距、版心
主色 + 辅色 + 点缀色(不是简单”主色是蓝色”,而是”主色用于标题块,辅色用于图表,点缀色用于高亮结论”)
标题层级(一级标题多大、二级标题缩进多少)
页脚、页码、引用源的呈现方式
卡片、边框、分割线、强调带的”语言风格”
字体的角色分工(标题用什么字、正文用什么字、注释用什么字)
为什么这事儿重要? 因为大多数人做学术 PPT 翻车,都翻在”视觉一致性“上:东一榔头西一棒槌,每页配色都不一样,每页排版都不一样,看着就”不专业”。模板 DNA 的本质是把”风格”从”感觉”变成”参数”。
三、5 步生产流程:从论文到可编辑 PPTX
scholar-ppt-cn 的默认工作流只有 5 步,每一步都有明确的输入输出和 QA 门控:
3.1 第 1 步:生产规划表(Production Planning Table)
这是整个工作流的”中央 artifact”,不是简单的目录大纲。它必须把每一页映射到:
编号 + 标题 + 叙事段落 + 沟通任务
源素材(Figure、表格、公式、引用段)
源素材几何(横版/竖版/双栏)
核心信息(一句话讲明白这一页要说啥)
内部版式 archetype(从版式库里选)
密度等级(低/中/高)
素材处理方式(保留原图/概览+细节/拆分/要求更高分辨率)
风险/QA 备注(事实核查、可读性、翻译、缺失素材等)
为什么这步关键? 它把”内容策划”和”视觉执行”解耦了——先把每一页要讲什么、拿什么讲、用什么版式讲讲清楚,再去生成,不会一上来就生成一堆图、然后发现逻辑乱了。
3.2 第 2 步:Mockup Family + Variants 蓝图
这是 v3.3 引入的正式阶段,夹在规划表和生成之间。它要做的事是:
重新确认模板 DNA:16:9 画布、页面色调、主辅色、背景风格、标题系统、页眉页脚、卡片/边框语言、图文比例、字体策略
定义 Mockup 家族表:Family ID(MF-01)、家族名、适用叙事段、适用沟通任务、适用素材几何、对应页码、视觉关键词、主要风险
为每个家族至少设计 3 个 variants:高频家族 4-6 个,每个 variant 要标 Variant ID、版式名、适用素材几何、对应页码、适用场景、禁止滥用
Slide-to-Family/Variant 映射:每个规划页对应哪个家族哪个 variant,备选 variant + 选择原因 + 可读性风险
选出 5-8 张代表性样张页:cover、报告地图、大图证据、多面板证据、图表解读、机制讨论、结论(按需)
家族 vs variant 的关系:家族是”视觉系统单位”,variant 是”具体版式选项”。两者都不是死板模板,可以根据内容灵活调整。
为什么需要这一步? 没有它,AI 生成的 PPT 经常前 5 页是左图右文、后 5 页变成上图下文、最后几页又变成纯文字——视觉系统是碎的。
3.3 第 3 步:Image Model 样板页(路线 A)
如果你想让 AI 先给你看几张”风格样张”,就走这条路线:
规划表 → Mockup family + variants 蓝图 → 模板 DNA → 图像模型生成 full-slide mockup variants → 用户确认 → 锁定视觉系统 → mockup 派生 archetype → 可编辑 PPTX 重建
关键规则:
每次先生成 1-2 张 pilot 测试视觉系统
发现 pilot 加了多余的模板标签 / 文字看不清 / 骨骼重复就修 prompt
之后按 2-3 张小批量生成
批与批之间停下来给用户确认,别一口气做完 5-8 张
图像模型中的文字是”provisional”的,最终交付前必须人工检查
图像模型可以决定:素材尺度、构图方向、解读区位置、图注位置、视觉节奏
注意:路线 A 的产物是”高完成度视觉稿”,不是可编辑 PPT。文字、图形、装饰元素不能像原生 PPT 一样逐项编辑——这是 image-first 路线本身的限制。
3.4 第 4 步:可编辑 PPTX 重建(路线 B)
如果你想跳过图像生成、直接出可编辑 PPT,走这条路线:
规划表 → Mockup family + variants 蓝图 → 模板 DNA → 详细版式 archetype 库 → 模板 DNA 参数化 → 可编辑 PPTX → QA
路线 B 必备:模板 DNA + 详细版式 archetype 库。光有 DNA 不够,必须有 archetype。
这条路线的产物是完全可编辑的 PPTX,文字、形状、图表都能二次修改,更适合学术场景(毕竟要插公式、改 Figure)。
3.5 第 5 步:Montage QA
最后一步把所有页拼起来做”对比蒙太奇”质量检查:
视觉一致性(颜色、字体、间距是否统一)
叙事连贯性(前后页是否衔接得上)
图文比例(每页信息量是否合理)
可读性(字号、对比度、留白)
引用完整性(公式编号、参考文献是否齐全)
注意:QA 必须诚实。如果在 ChatGPT 环境下没有渲染工具,不要假装做了检查,要明确说”哪些本地 QA 步骤还需要导出后再做”。
四、它支持 4 类叙事场景
scholar-ppt-cn 预设了 4 类 hidden narrative presets(叙事预设),你只要告诉它”做文献汇报 / 答辩 / 组会 / 课程”,它会自动套对应结构:
4.1 文献汇报 / Journal Club
默认叙事顺序(10-15 分钟约 14-18 页,复杂论文 18-24 页):
封面 → 报告地图/概述 → 背景/引言 → 研究空白/问题 → 目标/贡献 → 研究区/材料/数据/方法 → 结果/证据链 → 讨论/机制/解读 → 结论 → 致谢
4.2 学位答辩
默认叙事顺序:
封面 → 提纲 → 背景与意义 → 研究现状 → 研究空白/科学/实践问题 → 目标/内容/贡献 → 技术路线/数据/方法/工作量 → 主要章节/主要结果 → 综合讨论/机制/系统视角 → 结论与展望 → 致谢
4.3 课题组会
默认叙事顺序(更轻量):
封面 → 进展概览 → 研究问题/目标 → 已完成工作 → 关键结果 → 当前问题 → 下一步计划 → 讨论/所需帮助
4.4 通用课程/主题汇报
最简结构:
封面 → 背景 → 问题 → 主体 1 → 主体 2 → 主体 3 → 小结
关键设计:如果用户明确给了提纲或目录,以用户给的为准,不套预设。
五、和同类工具的差异
我把市面上主流的 AI 学术 PPT 工具拉了个横评(截至 2026-06-08):
| 工具 | 输出 | 视觉风格 | 可编辑 | 中文学术适配 | 模板 DNA | 来源 |
|---|---|---|---|---|---|---|
| scholar-ppt-cn | 可编辑 PPTX | 学术正经 | ✅ 全可编辑 | ✅ 专门优化 | ✅ 显式概念 | deathcats4/scholar-ppt-cn[1] |
| Gamma | 在线 PPT | 商务 marketing | ⚠️ 文字可改 | ❌ 偏西文 | ❌ 模板化 | gamma.app |
| Tome | 在线 PPT | 创意 marketing | ⚠️ 文字可改 | ❌ 偏西文 | ❌ 模板化 | tome.app |
| NotebookLM | PPT 草稿 | 商务 | ❌ 需转 PPTX | ❌ 英文优化 | ❌ | notebooklm.google.com |
| Codex + Image Gen | 一图一 PPT | 自由 | ❌ 全图拼成 | ⚠️ 看 prompt | ❌ | OpenAI Codex |
| codex-ppt (ningzimu) | 一图一 PPT | 风格统一 | ❌ 全图拼成 | ❌ 英文为主 | ⚠️ 风格锁 | GitHub[2] |
| ppt-master (hugohe3) | 可编辑 PPTX | 偏商务 | ✅ 全可编辑 | ⚠️ 通用 | ⚠️ 隐式 | GitHub[3] |
| ppt-image-first (NyxTides) | 全图 PPT | image-first | ❌ 全图拼成 | ⚠️ 看 prompt | ⚠️ 风格反演 | GitHub[4] |
| Anthropic 官方 pptx skill | 可编辑 PPTX | 通用 | ✅ 全可编辑 | ⚠️ 通用 | ❌ | GitHub[5] |
| Gabberflast/academic-pptx-skill | 可编辑 PPTX | 学术 | ✅ | ⚠️ 英文 | ❌ | GitHub[6] |

scholar-ppt-cn 的 4 个独门武器:
“模板 DNA”概念:把”风格”从玄学变成显式参数,19 份 rules 文件把 DNA 拆得明明白白(CJK 排版、版式 archetype、QA 等)
中文学术场景深度适配:CJK 字体规则、版式 archetype、参考文献引用格式全是中文
规划表是中央 artifact:不是”先 AI 生成再改”,而是”先规划再生成”,避免逻辑翻车
Mockup family + variants:在家族稳定性和变化自由度之间找到平衡,既不会千篇一律,也不会视觉系统碎裂
六、5 分钟上手指南
6.1 安装(Codex CLI)
# 1. 克隆仓库 git clone https://github.com/deathcats4/scholar-ppt-cn.git # 2. 复制 skill 到 Codex skills 目录 cp -r scholar-ppt-cn ~/.codex/skills/scholar-ppt-cn # 3. 重启 Codex codex
6.2 安装(Claude Code)
git clone https://github.com/deathcats4/scholar-ppt-cn.git cp -r scholar-ppt-cn ~/.claude/skills/scholar-ppt-cn
6.3 第一份组会 PPT
最简提示词(”这页图太小,字体不对,修一下”是其中一种常用语):
"参考 templates/scholar-ppt-cn-reference-template.pptx 这份模板, 我有一篇论文要做组会汇报 [附 PDF/链接/标题], 按 scholar-ppt-cn skill 的默认流程: 1. 先做生产规划表 2. 再做 Mockup family + variants 蓝图 3. 先做 5-8 张视觉样板给我确认 4. 确认后扩展成完整可编辑 PPTX"
6.4 实战小技巧
路线 A 还是 B? 想要精美视觉走 A,想要可编辑走 B。第一次用建议走 B,更稳
5 页参考模板是关键:你必须先让它读这份模板提取 DNA,否则出来的 PPT 没有”中文学术味”
规划表别省:哪怕赶时间也要把规划表过一遍,否则后面要返工
变体选择:如果某个家族只有 2 个 variant 不够用,可以让它”为 MF-02 增加 2 个 variants”
七、它的局限
star 数还不多:截至 2026-06-08 是 3 commits 的新项目,社区反馈有限,需要自己多试
路线 A 的文字问题:图像模型生成的中文可能有错字,最终交付前要逐页校对
依赖 AI 模型能力:底层 GPT-5.5 / Codex / Claude 的理解力直接决定输出质量
5 页参考模板不够丰富:如果你想要「国科大 PPT 模板」那种风格,需要自己提供参考模板
没有直接的”论文 PDF → PPT”按钮:还是要走规划 + 蓝图 + 生成的完整流程,5 分钟是熟练用户的速度
八、为什么这件事值得做
学术 PPT 的本质是”让评审老师沿清晰思路快速了解你的研究内容”。它不是”做漂亮的页面”,而是”组织一个故事”。
scholar-ppt-cn 把这件事结构化了:
提纲 → 故事结构
模板 DNA → 视觉一致性
详细版式库 → 页面节奏
Montage QA → 最终一致性
这一套方法论不止适用于学术 PPT,任何需要”先规划再生成”的内容创作都适用——产品文档、技术分享、投资汇报、政府报告。AI 时代的核心竞争力不是”会用 AI”,而是”会设计 AI 工作的流程”。
如果你正为组会 PPT 头疼、为开题答辩熬夜、为文献精读汇报抓狂——先跑通 scholar-ppt-cn 的 5 步流程,把规划表做好,剩下的 80% 时间你只需要确认视觉系统而不是从零开始排版。
相关链接
scholar-ppt-cn 仓库(GitHub)[7]
5 页参考模板(PPTX)[8]
本地工作流文档[9]
Anthropic 官方 pptx skill(通用对照)[10]
codex-ppt(image-first 对照)[11]
ppt-master(可编辑 PPTX 对照)[12]
清华大学学术 PPT 教程(PDF)[13]
37 Claude PPT Skills 横向评测(powerpoint.md)[14]
引用链接
[1]deathcats4/scholar-ppt-cn: https://github.com/deathcats4/scholar-ppt-cn
[2]GitHub: https://github.com/ningzimu/codex-ppt-skill
[3]GitHub: https://github.com/hugohe3/ppt-master
[4]GitHub: https://github.com/NyxTides/ppt-image-first
[5]GitHub: https://github.com/anthropics/skills/tree/main/skills/pptx
[6]GitHub: https://github.com/Gabberflast/academic-pptx-skill
[7]scholar-ppt-cn 仓库(GitHub): https://github.com/deathcats4/scholar-ppt-cn
[8]5 页参考模板(PPTX): https://github.com/deathcats4/scholar-ppt-cn/blob/main/assets/templates/scholar-ppt-cn-reference-template.pptx
[9]本地工作流文档: https://github.com/deathcats4/scholar-ppt-cn/blob/main/docs/local-workflow.md
[10]Anthropic 官方 pptx skill(通用对照): https://github.com/anthropics/skills/blob/main/skills/pptx/SKILL.md
[11]codex-ppt(image-first 对照): https://github.com/ningzimu/codex-ppt-skill
[12]ppt-master(可编辑 PPTX 对照): https://github.com/hugohe3/ppt-master
[13]清华大学学术 PPT 教程(PDF): http://chengqingli.com/htwrp_c/Mima-Academic-PPT-CN.pdf
[14]37 Claude PPT Skills 横向评测(powerpoint.md): https://powerpoint.md