AI 生成 PPT 的一次双场景实践:内容组织比排版难,交付物必须可编辑

0 阅读7分钟

先说这次在验证的问题:AI 生成 PPT,真正的难点到底在哪。

如果只追求"生成出来",现在工具都能做到。但实际用的时候你会发现两个更硬的问题:一是内容组织对不对——题材不同、受众不同,信息的排布逻辑完全不同;二是交付物能不能继续改——图能不能换、数据能不能动、结构能不能调。

基于这两点,用 Mirawork 跑了两份题材差异足够大的成片:一份 9 页的故宫历史讲解,一份 12 页的虚构咖啡品牌 A 轮融资路演。下面按复盘记录展开。

背景:为什么选这两个题材

选故宫,是因为历史文化类内容最容易做成一锅粥——景点、年份、建筑知识点平铺上去,页数够了,但读者看完什么也记不住。这类稿子的核心矛盾是信息密度控制。

选融资路演,是因为它有一套硬性的逻辑约束:投资人的问题必须被连续回答。市场多大、卖什么、为什么选你、单店赚不赚钱、规模怎么涨、钱花在哪。少回答一环,叙事就断。

两类内容放在一起,才能看出"内容组织"这件事到底是不是按题材自适应,而不是套一个通用模板。

案例一:故宫稿,9 页,信息按认知顺序排

这页稿子的做法,是把"认识一座宫城"设计成一条阅读路径:

  1. 封面用横向全景建立第一印象——故宫屋顶与北京城市天际线同框;
  2. 第 2 页先给尺度:600 余年、24 位皇帝、72 万平方米、9000 余间屋宇;
  3. 再进入北京中轴线与明清时间线;
  4. 然后逐个呈现太和殿、乾清宫、角楼等代表性建筑;
  5. 最后落到今天的故宫博物院,186 万件馆藏收尾。

顺序本身有讲究:先知道宫城多大,再理解它怎么布局、经历了什么,最后走近具体建筑。这条路径是"尺度 → 时间 → 空间 → 文物",比把知识点按重要程度堆一遍要顺得多。

视觉系统也跟题材绑定。主色米白、宫墙红、深褐;宋体扛大标题,黑体走正文;每页只放一个视觉重心,留白充足,关键数字单独放大,正文长度压到适合演示阅读。第 8 页的九龙壁是整页的视觉锚点——横向铺满页面下方,一个穿黄衣的孩子站在墙前,人物和建筑之间天然形成尺度参照,信息量不大,但记忆点很明确。

这里有个容易被忽略的坑,值得单独说:图片来源与授权。所有图片页都保留了作者、授权协议和 Wikimedia Commons 来源。历史文化类素材的授权直接决定文件能不能公开发布、能不能在交付后继续使用。这个信息一旦生成时不留,后面人工补的成本极高。

案例二:融资路演稿,12 页,按问题链搭叙事

融资稿的难点不是"美不美",是"论证链通不通"。这份稿子的页面顺序基本就是投资人提问的顺序:

  • 第 2 页:市场规模与增长示意;
  • 第 3 页:产品判断——"日常精品 + 中间价位";
  • 第 4 页:业务模式——直采、自有烘焙、门店现制;
  • 单店模型:日均 420 杯、客单价 19.5 元、单店月营收 24.6 万元、14 个月现金回本;
  • 继续展开门店增长、市场空间、竞争格局、财务展望;
  • 竞争页把 13–22 元价格带放进同类品牌对比;
  • 团队页交代核心成员分工;
  • 最后用 1.2 亿元 A 轮融资计划收尾。

换句话说,每一页都在回答前一个问题的"然后呢",最后一页落回"本轮融资用来干什么",闭环。

这里比较关键的一个实现细节是图表:稿子里有 4 个原生图表——市场规模、开店爬坡、门店增长、财务预测。它们是数据图表,不是截图。区别在哪?截图是一次性产物,改数据就得整页重做;原生图表是带数据结构的,经营假设一变,直接改数据源,图表自己更新。对路演这种每轮都要改数字的场景,这个差别是工作量级的。

视觉语言也随之换了体系:深绿、奶油白、陶土红为主色,少量金色提示重点;封面放手冲咖啡师建立品牌氛围,产品页放门店交付场景,融资页回到夜间门店外景。数据页的图片被主动减少,让数字和图表当页面主体——需要讲事实的时候,视觉元素让位给数据本身。

还有一个边界处理值得记:这是虚构品牌,市场规模、经营数据、财务预测全部标注了示意口径,可能引起事实误解的页面都保留了说明。样稿可以把商业故事讲完整,但事实与假设的边界必须让读者一眼看得到。

两类题材放在一起,能对比出什么

把两份稿子放在同一张表里看:

维度故宫稿融资路演稿
目标文化讲解融资沟通
信息组织控制密度,节奏推进建立论证链,环环相扣
视觉重心单页一个记忆点,靠图数据页让图退后,数字为主
配图全景 / 建筑,保留授权来源场景氛围图,与叙事段落对应

题材不同,字体、配色、图片比例、数据呈现方式全部跟着变。这不是换皮肤,是内容组织层面的差异。

但两者的交付物形态是一致的:可编辑的 PPTX。图片能替换、数字能修改、图表能编辑、文字与页面结构能继续调整。

这里其实藏着这套流程的定位——它交付的是"第一版",不是"终稿"。素材丢进去,说明汇报对象和使用场景,智能体完成阅读材料、梳理信息、组织内容、编排页面这一整段;判断、核对、修改、定稿这些事仍然留给人工。第一版生成得越快,人越能把时间花在真正需要判断的地方,而不是从空白页开始搭骨架。

一些可复用的结论

  1. 验收一份 AI 生成的 PPT,先看结构再看样式。结构是"内容组织是否匹配题材与受众",样式是"视觉语言是否与内容一致",两个都要过。
  2. 交付物能编辑比好看优先级更高。图表、数据、图片来源这些"带结构"的信息,决定了这份稿子能不能进入后续迭代,而不是一次性消费品。
  3. 事实与虚构的边界要显式标注。涉及数据、预测的演示内容,示意口径写清楚,既是对受众负责,也避免文件流转后被误当真实数据引用。

Mirawork 本身是本地运行的办公智能体,文件留在本机,支持 Word、Excel、PPT 等常见办公格式,客户端覆盖 Mac、Windows 和 Linux;除 PPT 外也做文档整理、表格分析和工作区资料归集。这次两份成片可以看作它"内容组织能力"的抽样测试——样本不多,但至少说明了一个方向:这类工作里,最难的部分从来不是把字排进页面。