DeepSeek涨价之后是不是真的用不起了?

0 阅读6分钟

关键词

DeepSeek-V4-Pro-0813DeepSeek Harnessdsh-web-uidsh-browser梁神模式

背景

DeepSeek-V4-Pro-0813涨价之后的第二天,也就是周一,兴冲冲地在公司电脑安装了几个插件,花费和前一天的对比如下:

image.png

image.png

image.png

image.png

08-16的输入命中缓存为99.04%08-17的输入命中缓存为97.35%,算下来每百万Tokens的单价分别为0.0701 RMB/M0.7398 RMB/M,10倍的差距!!!

如果减掉08-17输出tokens的消耗约2.93元,08-17百万Tokens的单价约为0.5314 RMB/M,差距也来到了7.5倍。

当时就直呼用不起!!!

但是由于08-1608-17这两天是处理的完全不同的事,因此我觉得这对比还是不够严谨,所以我就再做了个对照组。

用当时正准备修改的内容,分别用CodexDeepSeek Harness来进行测试,下面是配置对比:

配置如下:
DeepSeek:
模型:DeepSeek-V4-Pro-0813(峰价)
档位:Max
多模态:modlens(kimi-k3识图)
Agent:@deepseek-ai/dsh@0.1.0-rc.6
DeepSeek专武:dsh-web-ui插件的梁神模式

ChatGpt:
模型:gpt-5.6-sol
档位:Extra High
多模态:gpt-5.6-sol
Agent:@openai/codex@0.147.0(桌面版)
ChatGpt专武:无

测试内容为同一个问题,先让Codex找问题,Codex完成后再让DeepSeek Harness来找,不涉及修改代码,对话轮次都为两轮,给到的两轮对话内容完全一致,第二轮对话给到Codex/DeepSeek Harness测试数据库查询权限,进一步确认问题根因,结果如下:

Deepseek:
总用时:约48分钟
输入tokens:约27M
输出Tokens:约92.4k
花费:10+ RMB,小于11RMB,具体数值现在统计不到了(未计算k3的识图花费,因为K3还有其他调用)
问题是否解答:是
解答输出内容得分:90

ChatGpt:
总用时:约20分钟
输入tokens:未统计
输出Tokens:未统计
花费:接近2RMB,具体数值现在统计不到了
问题是否解答:是
解答输出内容得分:100

注:解答输出内容得分以更优的为基准,基准为100

由于gpt当时的tokens没有精确统计,所以无法计算百万Tokens单价,但从我长期的使用来看,差不多是在0.3-0.4 RMB/M这个区间内的,对比Deepseek百万Tokens单价(按花费10元算)为0.36 RMB/M,这样一看,DeepSeek-V4-Pro-0813好像也不是用不起,单价并没有超过gpt太多,但是问题就在于,这tokens花费要远远超过gpt-5.6-sol了,而如果使用标准模式,tokens花费倒是会少很多,但是输出的结果质量就不知道差多少了,回头有时间会再测试一下DeepSeek Harness官方的标准模式和社区插件的首轮对话锚定的“极简模式”满血版的tokens花费会有多大的差距,之前做过一个不严谨的测试但是没记录,大概几倍的差距还是有的。

社区变化

08-17测试之后,我就又回归了Codex的怀抱,但是这几天社区的变化如火如荼,围绕DeepSeek Harness的插件建设处于飞奔的状态,从dsh-plugin marketDSH HubAwesome DSH Plugin三大市场的插件数量来看,目前真实插件的数量可能很快就会接近1w+

image.png

image.png

image.png

dsh-plugin的质量目前参差不齐,之后如果DeepSeek Harness更新了breaking change,那么可能有相当大一批插件会受到影响,但其实dsh-plugin目前大多数也都是AI Coding产物,就算有了breaking change,到时候也能很快跟上。

都说大模型是炼丹,现在DeepSeek Harness和社区的dsh-plugin也给了我一种炼丹的感觉,只是这次炼丹的炉子是DeepSeek Harness,而炉子里面的炼丹材料是社区飞速增加的dsh-plugin,每一个dsh-plugin虽然可能是AI Coding产物,但不妨碍其中包含着制作者的思考,而这些思考才是DeepSeek Harness这个炉子炼丹的真正材料。

但是说实话,现在炸炉的情况太多了,哪怕是在DeepSeek Harness公测时就已经存在的插件,也存在着反复炸的情况,我这几天遇到过两次炸炉的情况,都是因为dsh-web-ui的升级,升级之后迁移有问题,直接DeepSeek Harness页面都崩掉,然后尝试卸载再重新安装最新版,结果卸载时产物也没卸载干净,DeepSeek Harness页面换个原因崩掉。

未来可期,当下折腾。

谷价测试

因为一直在关注社区的变化,家里电脑的chatgpt plus账号额度早用完了,所以昨晚就再次试了试DeepSeek Harness在谷价下的花费情况。

AI Coding的内容是我之前一直在做的一个浏览器插件 喵ingTab — 不写一行代码全靠AI的项目能做成什么样子?,目前正在开发中的1.3.0版本新增了三个小组件,主体在之前就已经实现了(先用DeepSeek Harness实现了第一版,但是和我想的相距甚远,然后用Codex重构),这一次就是加一些内容然后核实细节。

image.png

整体修改质量我还是比较认可的,和之前使用gpt 5.6-sol感觉不到明显差距,配置的话还是同上,但各插件和DeepSeek Harness都更新到了最新版本。

Deepseek:
模型:DeepSeek-V4-Pro-0813(谷价)
档位:Max
多模态:modlens(kimi-k3识图)
Agent:@deepseek-ai/dsh@0.1.0-rc.7
DeepSeek专武:dsh-web-ui插件的梁神模式

花费如下:

image.png image.png

由于在昨天测试之前08-18就已经花了3.09元,所以要减去这个花费,08-19也是昨天这次测试的花费(0.56 RMB),3.09元对应的Tokens我就记不住了,所以只能以对话中的Tokens消耗来测算,算下来百万Tokens单价约为0.22 RMB/M,当时我粗略一算,一下子还有点难以相信,这个价格其实已经能接受了,比最开始的0.07 RMB/M只贵了3倍左右,如果以后牢梁不缺卡了算力够了,再给我能用上0.10 RMB/M左右的DeepSeek,我将光速调节滑动变祖器至梁圣,并无情抛弃小奥。

image.png

其实昨天这次最惊喜的还不是测试花费,而是在dsh-browser的加成下,我再也不用打开调试窗口自己去看样式打开调试窗口然后截图给Codex了,所以在这一轮修改中我全程没有用到modlens识图,因为对于网页产品,我大概率没有截图的需求了,DeepSeek Harness借助dsh-browser直接看最新的页面就好了,我能鼠标点的它都可以做,对于网页形态的产物来说,现在唯一阻挠我不放弃Codex的就是DeepSeek的价格。

image.png

以上!