由于目前 AI 的 GUI 设计能力几乎是负分,Claude design 这类产品又比较重,不够简单,因此最近几个月设计类 Skill 可以说层出不穷。特别是在国内一直以来都是一个特殊设计行业存在的 PPT 行业,大量 PPT skill 被开源出现在 X、小红书和视频号中,其中以归藏的 ppt skill 作为出圈(项目链接:https://github.com/op7418/guizang-ppt-skill)。
其实 PPT skill 等一众设计 Skill 都是跟以前可画等网站一样的,就是一些 PPT 模板。不过不同的是,AI 可以比那些曾经用 PPT 模版的人要会用模版一些,不至于用模板依然做的很糟糕。
不过,我认为设计师是有一个特点的——他们每个人其实都有自己崇尚、喜欢或是顺手的一种或是几种风格,对于 PPT 这种展示性等内容,我觉得 PPT skill 倒不定是为了大众,即使是为了给自己提效,依然是一个好想法。

那么,要该如何制作一个自己的 PPT skill,让自己来制作 PPT 呢?
制作难题
首先我们得先了解一下,到底现在 AI 做 PPT 到底难点在哪、问题在哪,我们才知道在 Skill 的制作过程中要解决什么问题。我总结了一下,我认为主要是这些:
视觉美观度极低
就像文章开头说的,AI 本身的前端视觉能力是很弱的,因此视觉效果都比较拉跨,这也是之所以设计 Skill 出现的意义,可能没那么灵活,但至少不会出错。
视觉稳定性差
这是最大的问题,就是稳定性。PPT 不是像 AI 生图一样是,一张就结束了,它是一套“图”,视觉风格、语言风格等等都需要匹配,这是 AI 很难做到的。
如何稳定让 AI 从一篇文章变成 PPT
换句话来说就是,文章有了,AI 怎么知道该用什么?比如一个对比,AI 得知道这是要用一个对比的样式来展示这一页,而且他怎么知道这个该单独做一页面?
总结
综上所述,就是 PPT 类型的 AI skill 的难点和挑战。那么该如何解决呢?看了一些 Skill 的解决方案,再结合我自己的制作经验,我总结出了一套方案。
解决方案
在说明解决方案之前,我觉得我们要先构建一个基础共识:PPT 不同于传统的平面设计,它的页面种类是有固定数量的,例如封面、对比页、目录页、过渡页等等。我这里列出了PPT 常见的各类页面。
页面种类 | 用处说明 |
|---|---|
封面页 | 整套 PPT 开场、建立视觉基调 |
章节过渡页 | 分幕、换章节、制造呼吸 |
目录 / 索引页 | 展示章节结构、内容索引 |
观点宣言页 | 一句话观点、核心判断、口号 |
大引用 / 金句页 | 放一句强表达或 takeaway |
收尾页 | 总结、takeaway、结束页 |
数据大字报 | 用几个大数字建立冲击 |
KPI / 指标页 | 展示核心指标、账单式数据、benchmark |
条形图 / 排名页 | 5-10 项排名、占比、评分比较 |
时间线页 | 年代演变、版本演进、过程节点 |
流程 / Pipeline 页 | 多步骤流程、工作流、操作链路 |
闭环流程页 | 循环、反馈回路、agent loop |
对比页 | Before/After、A/B、旧/新模式 |
3/4/6 项信息展示页 | 功能点、概念、原则、模块并列 |
矩阵页 | 8-12 个同类项、证据集合、能力矩阵 |
系统 / 架构图页 | 三层结构、生态系统、关系结构 |
图片网格页 | 多图证据、截图墙、案例对比 |
图文混排页 | 左文右图、右文左图、文字 + 图片证据 |
主图案例页 | 一张大图 + 标题块 + KPI |
地图 / 地理关系页 | 城市、路线、地点、人物住所关系 |
也就是说,任何一个 PPT,几乎不会超出这些页面种类,这也就是为什么 PPT 设计可以 Skill 化的原因,我曾经在一篇 Skill 的文章里面介绍过,AI直接做设计能力几乎是没法用的,但是可以利用 html 这种代码制作模板(文章:来点儿 Skill:不是把 AI 变万能,而是把重复工作做扎实),而且也介绍过 21st、react bits 这一类AI 提示词组件库,其提示词其实就是 css 代码和 html 代码搭配自然语言说明。
那么,这样我们的解决方案也就不言而喻了:
视觉美观度极低:穷举各类页面的布局模板,强制要求 AI 必须遵守不同内容引用对应页面的规则,并且要求不允许自己制作全新的布局页面;
视觉稳定性差:内置一套样式和布局体系,并且收束规范要求 AI 不允许自己新增新的样式、布局,只能使用可以检索到的给出的内容;
稳定拆分文案:在提示词中做好约束,做好拆分页面的要求,并且为每一个页面都做好描述文案,告知 AI 每一个页面用来做什么,并且在模版中加入反向注入提示词机制,进一步减少出错。
除此之外,还有2个新的问题出现,其中就是 icon 问题,做过 Vibe coding 的大家肯定都遇到过,就是直接用 html不上前端框架例如 react 或者 vue,就会出现 icon 无法加载、无法渲染的问题,这种问题一般是 2 种解决方案:
提前下载到本地,和 skill 一起打包,传统的 PPT 模板也是这么做的;
规定好对应的 icon 库,模版里这些留好空位,需要 icon 就让 AI 找到合适的然后去对应网站下载,例如 guizang ppt skill 里面就用的 lucide icon。
<i data-lucide="layers"></i>另一个问题就是字体,我们没法保证字体的统一性,让每一个人都有这些字体,解决方案也很简单,告知 AI 使用 Google font 即可。
具体工作流
下面,我们来介绍具体工作流程。
制定视觉规范
你可以用很多方式来设计你的 PPT 模板内容然后让 AI 做成 html,例如 Figma,甚至直接 AI 来写你在做调整。
具体要做哪些页面,就要看到我上面说的穷举页面了。
一说到视觉规范,可能大概率我们都会想到 design.md 这个东西,但是我在 PPT skill 里面,我反而不建议。这里说一下为什么。最主要的原因是就是 design.md 的限制不够,规范不够紧,在这种 PPT skill 里面,最忌讳的不是设计不够灵活,而是 AI 自由发挥了,是一种反逻辑。通过 design.md的我相信都会发现这个东西只擅长做一些基础的设计主题、样式和基础交互规范,并不适合定死。
因此在这里,更建议的就是准备一下样式文档和布局文档在 skill 里面。
做好必要的标注
做好了 html 模板的代码,下一步就是要让 AI 能知道这些都该在哪用,怎么用,因为 PPT 一般还包含文字,所以还得让 AI 这些要写些什么,还不能写多了等等。
这里主要靠 2 项,一个是反向注入提示词,一个是做好 md 文档的标注。
反向注入提示词
这里之前在讲 skill 的制作方法的时候也有过介绍。
如下图所示,你会发现,这里并不会像传统的模板那样,给一个示例文案,比如左文右图作为大标题,会假设一个场景的 PPT,例如写着“AI skill 分享”。错!不要这么做,这里也要当做提示词来放内容。

上图的左图右文,或者下面的左侧讲论点,右侧放证据图和产品截图(实际的 html里面甚至还会标注是否是必填内容),就是为了让 AI 在获取到这个 html 的时候读取到这些信息,这样 AI 就知道这里要放什么东西,怎么放,这看起来就是个很小的细节,但是确实很关键!

做好文档标注
以归藏的 skill 为例,其所有页面都是类似 21st 和 reactbits 一样,使用介绍搭配 html 和 css 代码构建的提示词文档,就像下图。

开始收束
在解决方案我们讲了一些必要的规范约束,比如不允许从之外的地方获取样式和布局等等,这些要在这一步尽可能的约束,时刻要注意,这种 skill 的核心就是要几乎没有灵活性——反而就成功了。
约束我认为分为 3 类,一类是对样式的约束就像刚才举的例子一样,还有一类是 边界问题解决方案约束,最后就是防止 AI偷懒的约束。
样式约束
这部分可以用 AI 来帮我们更快的梳理,当然你也可以找一些开源的 skill 来看他们是怎么做的,一般来说文档会比较多、比较复杂。

边界问题解决方案约束
这个在这一步可能很难穷举完全,就算是有 AI 的帮助,还要在后续的测试中不断的改进。
PPT skill 最常见的问题就是字数爆炸了,这一页塞得满满的。这些都是实际会遇到的问题,我们就要告诉 AI 解决方案,一般要做以下这些约束:
不允许缩小字号,最小字号不能小于 18px;
选择拆页分开这部分内容;
实在无法处理考虑精简文案。
这些具体的边界问题可能是很考验设计师的设计功底的地方,也是这些 skill 最难的地方。
防偷懒约束
我们刚才说到的 AI 会偷懒,比如你做了这么多种模板,给了AI 文章,他会偷懒故意把内容放在那种 6 个宫格卡片里,十几页的东西压缩到一页。这也是我们要尽力避免的。
这个如何解决呢?其实也是个老方法,我不知道大家是否有用过 25 年中旬大量出现的一些 AI 写作 Agent,他们大多数的流程就是先按照用户需求生成大纲,有的甚至还允许用户修改大纲,然后确定后再生成文档。这个 PPT skill 要解决这个问题也是如此,那就是要求 AI 先生成大纲,防止他偷懒,必须按照大纲来走 PPT 的展示动线,不允许一口气塞满。
这部分也有一个 skill 来帮助你,github 仓库在这里:https://github.com/LearnPrompt/humanize-ppt
不断测试调整
如果上前面的步骤花掉了你 2 天的时间,那么这一步可能会花掉你 3-5 倍甚至更多的时间。那就是不断的测试,当然并不需要你想测试工程师一样写用例来测试,但是需要你不断的测试Skill 的稳定性,有一个取巧的方式那就是找别人来帮你测试,这样更容易找到问题。
你去观察很多 PPT skill 就会发现很多类似补充的说明,例如上一张图里,红框下面就有标明“风格 AI 常见容易遗漏的类”,这种东西肯定不可能不用测试就能猜到的,都是在不断的测试中发现让 AI 不断修复改出来的东西。
最终就会趋于稳定,最终稳定后就可以成为一个可交付的 PPT skill。
额外注意事项
如果使用 html 作为最终的展示结果(就像归藏的 skill 一样),那么就可以考虑 webGL 来做动画效果,当然你可以执行 JS 脚本导出为 PPTX 格式。
但是经过我实际的测试,如果你有这一步操作,就不建议增加刚才说的东西了,这些东西会导致 AI 的输出出现问题。
总结
这套流程整体的思路我认为就是一个:让 AI 不能自由发挥,用牺牲几乎全部的灵活性换取稳定的高质量。在实际的测试中,我们就会发现真正难的可不是 AI 做不出来 PPT,而是让它听话按照我们的给的模板来做 PPT。
整体来说,这个 Skill 的全流程也可以做出概括:
让 AI 明确一些基础问题(这一步也可以没有),例如 PPT 风格(在你有多种 PPT 风格在一个 skill 里面的时候)、PPT 内容特点等等。
AI 开始查看文稿或者项目,梳理一个大纲流程;
AI 开始查看资产模板和约束,开始输出一个 html 文件,制作 PPT;
综上所述,便是一整套 PPT skill 的工作流,设计 Skill 确实相比开发相关的 skill 略显尴尬,就像我开篇说的,它就是一种模板,让一种超凡的设计平庸大众化,最后变得让人厌恶——想想 Claude 的设计语言曾经多么震撼,结果现在...
但是,我们依然不可否认,有了这些 Skill 的出现,至少我们不会再看到那么多 AI slop 那种蓝紫渐变、大圆角、暖灰配色,悬停浮动卡片等等,依然是一件好事。