我之前发过一个「skill 方法论」系列,讲的是怎么把工作方法做成 skill:任务识别、方法抽象、规则迭代。那套解决的是「怎么创建」。
最近刷到一个讲「商用级 skill 怎么设计」的视频,补上了我漏掉的一环:怎么验收。视频给的框架是五个问题——
- 解决什么任务
- 什么时候触发
- 过程分几步
- 必须遵守什么
- 最后交付什么
我拿这五问反过来验收了自己在用的 6 个 skill,结果是:3 个一次通过,2 个补了短板,1 个被我发现压根不合格。这篇把验收过程原样复盘,你可以直接拿这五问去拷打自己的 skill。

第一问:解决什么任务——一句话说不清,就不是 skill
合格的答案长这样(我写的文章排版 skill):
把 Markdown 一键排成可直接粘贴进公众号编辑器的内联样式 HTML。
任务、输入、输出,一句话齐全。不合格的答案是「帮我提高效率」「处理文章相关的事」——任务边界模糊的 skill,AI 每次都要重新猜该干嘛,效果必然飘。
验收标准:把 skill 的描述念给一个不懂技术的朋友听,他能复述出「它是干嘛的」吗?

第二问:什么时候触发——触发词写不准,等于没写
这是我被补课最多的一问。我的发布 skill 最早的触发描述是「发布文章时用」,结果 Claude Code 在「读一篇已发布文章」时也误触发。
后来改成了枚举式触发词:「发布」「待发布」「归档」「审核这篇」全列上,再加上反向边界「只读文章不触发」。误触发率直接归零。
验收标准:触发词是否枚举到了用户的真实说法?是否写了「什么时候不触发」?
第三问:过程分几步——没有编号的流程,AI 会自己发挥
打开我任何一个跑得住的 skill,流程都是编号列表。比如文章 skill 的六步:
① 写文章 → ② 人工确认内容 → ③ 生图 → ④ 人工确认图片 → ⑤ 脱敏+传图 → ⑥ 进入待发布
每一步有明确的产出物和下一步入口。对比一下失败的写法:「先写好文章,然后配图发布」——「然后」两个字之间,AI 能给你脑补出八种顺序。
验收标准:流程能否不假思索地按编号念出来?每步的产出物是否明确?
第四问:必须遵守什么——硬规则要写成「红线」,不是「建议」
这是我的发布 skill 里最值钱的部分,全是踩坑踩出来的:
- 内容没确认就生图、图没确认就上传,都是返工重灾区 → 写成硬卡点
- 先脱敏、再传图,顺序固定 → 写成顺序规则
- 严禁真实项目名 → 写成红线
关键写法是标注严重性:「⛔ 未确认不生图」和「建议确认后生图」,AI 对这两种措辞的遵守度天差地别。
验收标准:规则里有没有「尽量」「最好」这种软词?有就改成「必须/禁止」。
第五问:最后交付什么——交付物不明确,等于任务没终点
每个 skill 的最后一行都该能填进这句话:「跑完之后,___ 出现在 ___,状态是 ___。」
我的发布 skill:文章出现在发布队列,frontmatter 的 status 字段变为对应状态,邮件报告逐平台带链接。验收一篇文章有没有发完,不看 AI 说「发完了」,看字段和链接。
验收标准:交付物能否被独立验证(不依赖 AI 自己的汇报)?

验收结果汇总
| 我的 skill | 五问通过情况 | 补的课 |
|---|---|---|
| 文章写作 | ✅ 全过 | — |
| 文章配图 | ✅ 全过 | — |
| 发布流程 | 4/5 | 补了反向触发边界(第二问) |
| 汇报页生成 | 4/5 | 补了交付物验证方式(第五问) |
| 原型部署 | ✅ 全过 | — |
| 某个早期 skill | ❌ 不合格 | 任务边界模糊,拆成两个重做 |

那个不合格的早期 skill 就是典型的「玩具级」:创建时图快,五问里三问答不上来。拆完重做之后,反而成了使用频率最高的之一。
一句话总结:创建 skill 靠抽象能力,验收 skill 靠这五个问题。创建决定它能不能跑,验收决定它能不能稳定跑一年。
下一篇预告:《Prompt→Context→Loop→Graph》——skill 解决的是「把方法教给 AI」,但想让 AI 从头到尾自动干活,光有 skill 还不够,我把自己的自动发布流水线拆开,讲清这四层工程各自管什么。
如果这篇对你有用,欢迎关注看「AI 工具人 PM 实战」系列新篇;你用这五问验收自己的 skill,会挂掉几个?评论聊聊;觉得有用就收藏备用。