DeepSeek 的 dsh 是个“一切都是插件”的 agent 框架。我装了它之后做日常工作又快了一截。但我嫌两件事太“裸”:一是 dsh 给我方案我不敢直接接受;二是不同模型各有什么脾气我心里没底。我写了两个小工具把这俩事接住,今天就讲讲。
仓库:
欢迎试用,issue 随便开。如果你已经装好 dsh,30 秒就能装上。
1. 让模型的方案先“被核查”再落地
DSH-changeproof(GitHub)给 dsh 加了 3 个工具:plan / verify / status。plan 在改之前先记一份回退包;verify 改完之后逐项对账;status 看你现在在哪一步。我日常就让 dsh 改一段代码,结束时不看 diff,先让它跑 verify,对不上的列出来。
这不是要取代 git,是补上“模型说要做的事”和“仓库里实际发生的事”之间那段对账。dSH 在真实项目里改代码很灵,但灵的反面就是容易做多、做歪。verify 把这两个问题量化了。
2. 同题跑一次
DSH-arena(GitHub)是本地实验台,dSH 里现在没有这个能力,我经常需要,所以自己写了。它做一件事:把同一道题发给 N 个候选模型,按“成绩单”摆出来。
成绩单包括:跑通/没跑通、跑多久、门禁(这个就是 changeproof 那个工具的判定思路)、建议胜者、帕累托前沿、审计告警。所有数据落在本地 .dsh-arena/ 里,不联网。
我特意保了 3 件事:
- 默认有“执行开关”,不主动跑实验;
- 每个候选可以独立开关,贵的模型可以默认关;
- 不替我选最终的赢,只出成绩。
3. 装法(两句话)
cd E:\agent\DSH
pnpm dsh plugin --profile web add <本地路径>
4. 一个朴素的结论
dsh 解决的是“怎么把 agent 拼起来”,但工程上要自己补一些习惯。我这两件加上去,dSH 在我日常里才真正能放心用——这听起来没什么大词,但就是让 dSH 用得起来的关键。