1M 上下文 + 770B 参数,限免到 9 月 10 日
价格都按各家官方页面当期公示的算。文里的数据来自 2026 年 8 到 9 月的公开报道,时效性挺强,你看到这篇的时候可能又变了。
便宜的 Token 正在变贵
8 月 17 日零点,DeepSeek 的新定价生效。
- V4-Pro 高峰时段输出:6 元/百万 tokens 涨到 27 元,涨了 350%
- 输入(缓存未命中):3 元涨到 9 元,涨 200%
- 输入(缓存命中):0.025 元涨到 0.3 元,涨 1100%
- 高峰时段是北京时间 9:00—12:00 和 14:00—18:00,其余算空闲,按高峰的一半收
DeepSeek 一直是"极致性价比"那挂的。跑 7×24 小时的智能体、长任务批处理这类活,选它就是图便宜。这一刀下来,最难受的正是这些持续烧 Token 的场景。
而且不是它一家在涨。
| 时间 | 厂商 | 动作 |
|---|---|---|
| 2 月 12 日 | 智谱 | GLM Coding Plan 结构性上调,被视为本轮涨价"第一枪" |
| 3 月 / 4 月 | 智谱 | GLM-5-Turbo 上调 20%,GLM-5.1 再上调 10% |
| 3 月 | 腾讯云、阿里云、百度智能云 | AI 算力产品同步上调,涨幅 5%—34% |
| 6 月 1 日 | MiniMax | M3 发布,API 价格全面翻倍 |
| 7 月 | 月之暗面 | Kimi K3 输入 20 元/百万 tokens、输出 100 元,较前代涨超 3 倍 |
| 8 月 17 日 | DeepSeek | V4 全系列大幅上调,引入峰谷定价 |
摩根士丹利有份研报叫《告别价格战,打响智力战》,统计了八家厂商的官方报价:2026 年二季度,国内大模型 API 平均输入价 4.9 元/百万 Token、输出 21.9 元;2025 年一季度这两个数是 3.3 元和 12.2 元。一年多时间,涨了 48% 和 80%。
价格底部被抬起来了。这不是某一家想多赚点,是整条链的成本结构变了。
这事儿跟写代码的人有什么关系
API 涨价,最直接的一层就是开发者。
第一财经采访过一个开发者,他的应用靠 AI 解析屏幕内容生成待办。涨价前每月 API 支出大概 3000 元,按同样的用量和时段分布算,调价后奔着 1 万去了。他原本不打算对用户收费,现在开始考虑把 AI 服务改成付费项。
上游算力贵了,中间层应用的成本就涨,原本免费或低价的功能开始收费。就这么一条线。
所以挑 AI 工具的时候,值得多问一句:它长期用下去的成本,是不是你自己能控的。
这也是为什么下面要把 WorkBuddy 这笔账单独算一遍。
WorkBuddy 是个什么东西
腾讯出的,全场景 AI 工作台。
关键是"工作台"这三个字。它跟常见的 AI 聊天窗口不是一回事:你说一句,它自己拆步骤、排顺序、调工具,最后交给你的是改动过的文件和能跑起来的结果,不是贴在对话框里的一段代码。
对写代码的人来说,这个区别很实际。它读的是本地真实的项目,改的也是真实文件,不用把代码复制来粘贴去。
写代码的时候它能干什么
读懂一个陌生项目。把仓库丢给它,问模块怎么划分、入口在哪、某个功能的实现路径,它是真的去读文件再回答,不是靠猜。跨文件的调用关系也能理出来。
写代码和改代码。给清楚背景和约束,它直接改本地文件。接着追问"这个分支换个写法""把错误处理补上"是连续的,不用重开一轮。
重构和批量改动。这项最容易被忽略。一个接口改了签名,所有调用点跟着改,或者全项目统一替换某种写法,几百处一句话的事。
调试。把报错栈丢进去,它结合项目上下文定位,不用把相关文件一段段贴过去。
补测试和文档。单测、模块注释、README、接口文档,这类产出规整的活交给它最划算。
代码审查。让它按安全、性能、可维护性几组视角过一遍改动,人再审它标出来的点,比自己全看要快。
成本这块怎么压下来
WorkBuddy 走积分制,调模型、用插件、装第三方 Skill 都消耗积分。
能不能控住,主要看两件事:有没有稳定的进项,以及你会不会省。
眼下最值的一件事:Hy4 preview 正在免费
8 月 28 日腾讯混元的 Hy4 preview 上线,WorkBuddy 同步接入,限免到 9 月 10 日 23:59。
切过去不用配置,在对话框那个模型选择按钮里找到 Hy4 preview 选上就行。模型列表上它标着 0.00x,也就是这段时间用它不扣积分。
规格是总参数 770B、激活 49B、上下文 1M。1M 是什么概念,几万行代码可以整个仓库丢进去,不用自己切段。跨文件的调用关系它自己能理出来,这种活以前得分好几轮问。
同一时间 Hy3 也免费,延长到 9 月 30 日 23:59,倍率 0.05x。
几个坑提前说一下,都是实际用下来会碰到的:
- 每天有免费额度,用完要么等第二天重置,要么花积分继续。页面会提示重置时间,不用瞎猜。
- 用的人多的时候白天容易排队。不着急的活可以放到晚上 23 点以后,实测顺畅不少。
- Hy4 和 Hy3 都是纯文本模型,让它生图或者做视频,系统会自动切到别的多模态模型,那部分照常扣积分。所以别拿它去硬刚这类活,白等还白花积分。
官方也提过 Hy4 preview 有个毛病:复杂任务里容易"想太多",反复自我验证。让它改一个逻辑并不复杂的脚本,它也会在那儿来回确认好几轮。碰到这种情况,把任务拆细一点、边界说清楚就好。
每天签到
客户端左下角点头像,里面有个 Buddy 加油站,每天能领一次积分。
| 连续天数 | 每日到账 | 备注 |
|---|---|---|
| 第 1—6 天 | 100 积分/天 | 每天固定 |
| 第 7 天 | +1000 积分 | 一次性 |
| 第 8 天起 | 重新计数 | 断签清零 |
每天 100,连签一周额外给 1000,满勤一个月下来 3000 到 4000 积分。轻度使用基本够覆盖日常消耗,点一下几秒钟的事,别的什么都不用做。
每月基础额度和新手任务
除了签到,账号每月会自动到账一笔基础积分,体验版是 500,不用手动领。
新手期还有个成长计划,完成新建任务、对话、用模板、召唤专家这类引导动作,一套做下来又有近千积分。这些任务本身就是带你熟悉功能,做完不亏——不过有个坑,得先点"去完成"再操作,否则不计进度,容易白做。
连登打卡也在这个页面里,完成一次对话算打卡一天,连登 14 天、28 天另有奖励。
拉几个人一起用
个人中心里有专属链接,复制发出去就行。别人通过这个链接第一次用上,双方都有积分进账。
| 触发条件 | 到手积分 |
|---|---|
| 好友通过链接首次使用 | 50 |
| 好友 7 日内累计使用 3 天 | 100 |
| 好友 30 天内首次付费升级 | 双方各 500 |
一个人累计 650 封顶。
新用户走链接注册,自己也有一份注册礼,额度以当期页面显示的为准。
两个地方容易算错:活跃奖看的是对方实际使用的天数,只注册不打开不计入;三档奖励按人头分别累计,不是一次给完。
更关键的是:别乱花
省比赚容易得多。
同一个问题换不同模型,消耗能差一个数量级。WorkBuddy 里每个模型都标着消耗倍率:Hy3 是 0.05x,GLM-5.3 这类第三方是 0.79x,中间差十几倍。简单地问一句,没必要动用贵的。
大致可以这么分:
- 整个仓库、跨文件分析、长代码 → Hy4 preview,限免期内不花积分
- 单文件改写、摘要、日常问答 → Hy3,0.05x,就算限免结束也不心疼
- 生图、视频这类多模态活 → 反正要切别的模型,挑个晚上跑
原则是别拿 Hy4 的免费份额去喂"给这个函数加个注释"这种活,把它留给真正吃上下文的硬活。
进项加节流,积分基本不会见底。
一个具体的例子
接手一个没有文档的旧项目,最耗时间的是摸清结构:入口在哪、模块怎么分、某个功能的实现路径是什么。
把仓库目录授权给它,先让它通读一遍,输出模块划分和调用关系,再针对具体功能点往下问。原本要翻好几天的活,一轮对话能问到七八成,剩下的对着文件核一遍就行。
这类"范围大、规则清楚、重复劳动多"的事最适合交给它。上下文越长越占便宜,这也是 1M 窗口真正有用的地方。
几句实在话
它也不是万能的。
任务描述得写清背景。同样一句"帮我优化这段代码",把性能目标、运行环境、能改和不能改的边界说清楚,交付质量差很多。这是投入产出比最高的一步,值得多花三十秒。
大任务要拆小。一次性让它重构整个模块容易顾此失彼,拆成两三步反而更稳、更快。
重要结论自己核一遍。它会给出引用和实现,但涉及上线的改动,diff 还是自己过一遍比较稳妥。模型会编,这事到现在还是这样。
积分规则会调整。签到给的额度、活动周期都可能变,看到这篇的时候请以客户端里当期显示的为准。
最后
涨价这事,短期看是成本压力,长期看是行业从"低价获客"往"价值定价"走的过程。价格战打完了,接下来拼的是能力。
但问题还是那个:这段时间里,怎么用可控的成本把 AI 真正用起来。
挑一个能交成品的工具,把重复劳动丢给它,然后把账算清楚:哪些活值得花积分,哪些不值得,每天该领的别落下。
对了,9 月 10 日之前 Hy4 preview 是免费的,想试就这半个月,过了按 0.29x 计。
如果你身边也有每天跟代码和文档打交道的同行,把这篇转过去,也许能帮他省点时间。