删了试试,AI降智秒解(上篇)

38 阅读5分钟

最近不管是换用 GPT-5.6-Sol 还是各类推理模型,写代码时反而经常觉得它反应迟钝,而且token消耗有点大,不听指令以及处理时间过长的事情屡见不鲜,我第一反应难道是模型降智了?但是降智的话也不应该全部模型都降智啊。

突然想起之前Claude Code 团队的人里提到,他们在Claude 5 模型里删了80%的系统提示词,但是表现良好,感兴趣的可以点阅读原文看看他们发布的博客。

image.png

现在的harness自己就具备代码检索和编辑边界意识,客户端的工具链也有底层校验,以前手把手教的内容早就成了模型常识。

也就是说我们的CLAUDE.md 或者 AGENTS.md 不用写那么多提示词,Agent 也不用装那么多skill、mcp和插件等工具了,很多能力都已经内化到harness里去了,不然反而效果更差。

有的朋友可能会问什么是harness?简单地说它就是运行大模型的底座,包括工具使用、记忆、状态持久性、执行环境及回馈回路等。

现在挺流行的定义:Agent = Model + Harness。

模型越强,旧规则越像噪音

翻开这些文件看了看,其实全是我这大半年写代码时慢慢攒下的。回想起来我最早用的Agent是Google Antigravity,然后是 Claude Code,最近主要是 Codex ,谁让A➗封我号了。

每次遇到 AI 犯错,我就习惯性在对应项目的 CLAUDE.md 或者 AGENTS.md 里加一条规矩:AI 乱改别的文件了加一条,漏跑测试了加一条,群里看到别人分享的所谓架构师提示词也往里粘。不同 Agent 的文件不统一,有重复的也有不同的。

日积月累,全局和项目的配置文件直接变成了一本厚厚且杂乱的说明书。

image.png

我电脑里的这几千行旧规则现在成了负资产。一方面规则太长会挤占有效上下文,关键的项目命令写在后面经常被直接漏读;另一方面我平时 Claude Code、Codex 和 Antigravity 换着用,每个工具存一份配置,时间一久各处命令对不上,同一个项目在不同客户端里跑出完全不同的行为。

我把所有配置推倒重写了

全局事实源只保留 ~/.codex/AGENTS.md 并缩减到 36 行;
~/.claude/CLAUDE.md 仅用一行 @~/.codex/AGENTS.md 引用;
Antigravity 的 ~/.gemini/GEMINI.md 同步维护一份 30 多行的版本;
20 个项目根目录的规则逐个重写并压缩在 20 行左右,只留专用的 build 和 test 指令。

image.png

image.png

总行数从 6594 降到了 736,降幅 88.8%。在 Antigravity 界面实测,全局规则初始化从几千 Token 降到了 956 Tokens。

让 AI 跑的两段话

我让AI处理完后让他将我上面所做的事情整理成了两端提示词,你可以拿去用:

给我扫一下本机所有 AI 规则(~/.codex/AGENTS.md、~/.claude/CLAUDE.md、~/.gemini/GEMINI.md 和各个项目目录下的配置),只读分析,千万别改文件。把里面的废话、通用教程和过时命令揪出来,全局统一收敛到 AGENTS.md(CLAUDE.md 单行引用),各个项目只留专用的跑测与构建命令,压缩到 30 行内。先给我看行数统计和精简方案。
就按这个方案改。修改前务必先完整备份到 ~/.agent-instructions-backups/ 带时间戳的目录并生成 SHA256 校验,写完后把前后的行数对比打给我。

改完这套配置跑了几天,最直观的体会是它手脚干净多了,不再借着改小需求到处动无关代码,切不同工具也不用反复折腾环境。

只用Claude Code 更推荐你使用这个指更

准备发这篇文章前才发现 Claude Code 已经有这样类似的功能了,还是 Claude Code之父推荐的。

只需要执行简单的checkup指令,也就是之前的doctor,不过这个指令只能处理Claude Code的配置,其他Agent不适用。

image.png

/checkup

这个指令除了claude.md,skill、MCP、插件都会一并清理。而skill、mcp其实我在执行这个指令前也已经处理过一轮,这次执行这个命令再次做了修补,效果还可以,可以看看下面的图片。

image.png

上下文加载机制

在这次执行doctor指令期间,Claude Code还解答了两个我之前对于上下文加载的疑问: 1.skill列表的上下文加载预算是多少? 答:约等于上下文窗口的 1%,200K 窗口约为 2K toekns,他说我之前使用了 4.6K ,怪不得我之前使用一下模型会发现斜杠命令搜不到一些skills,原因竟然是在这里。 不过现在 SOTA 模型基本都是百万上下文窗口了,可以支持 10K ,不过没必要加载就不加载毕竟浪费token也影响性能不是。

2.Claude.md 的加载逻辑是怎样的? 答:我之前看到有人说只加载前200行,原来不是的,说的是memory.md。而Claude.md会完整加载,200行只是写作建议,太长会降低服从度。


结语

关于Claude.md 和 Agent.md 这些Agent的定义文档的清理就说到这了,如果你觉得有帮助,欢迎点赞、转发、点击在看和评论区留言。

下篇再聊聊我是怎么梳理 MCP 和 Skills 的。

p.s.可接 1v1 咨询和 skill & 工作流定制,欢迎联系。

推荐阅读

删了试试,AI降智秒解(下篇)

拿到工信部备案号就完事了?很多人都漏了最后这两关

本想只加个定价信息,结果顺手把整个网站的“AI 味”全删了