DeepSeek 之前一轮涨价之后,最近宣布降价了,网友调侃又是梁圣回来了。
简单来说是,从北京时间 9 月 10 日中午 12 点起,Flash 系列 API 下调价格,缓存命中输入的单价降幅达到 60%。
与此同时,DeepSeek 还放出了约 150 个工程岗位。
今天来一起说下这两件事,它反映出了未来 AI 的发展方向和人才需求。
1. 这次到底降了多少
下面都是 Flash 系列空闲时段的官方价格,单位是元/百万 token。
| 计费项目 | 调整前 | 9 月 10 日 12 点起 | 降幅 |
|---|---|---|---|
| 输入,缓存命中 | 0.05 | 0.02 | 60% |
| 输入,缓存未命中 | 1.5 | 1 | 约 33.3% |
| 输出 | 4.5 | 4 | 约 11.1% |
降得最多的是缓存命中输入。做多轮 Agent 任务时,一部分相同内容会反复传给模型,命中缓存后,这部分输入就按更低的价格结算。
但整张账单能省多少,得看你的任务。输出降幅是约 11.1%,不能拿缓存项的 60% 套到所有费用上。
高峰时段仍按闲时的两倍收费,新价格分别是 0.04 元,2 元和 8 元。高峰是北京时间周一到周五 9 点到 12 点,14 点到 18 点,其余时间按闲时计费。
价格之外,还有一件值得注意的事:V4.1 Flash 已经开放内测,官方计划在北京时间 9 月 10 日前后正式发布。截至 9 月 9 日,还要按内测版来看。
官方称,经过内部和外部测试,它在性能,费用,速度和总用时等指标上,已经全面超越 V4 Pro。正式上线后,到 V4.1 Pro 上线前,V4 Pro 的请求会全部转到 V4.1 Flash,并按后者单价计费。
所以,Flash 本身降价,以及 Pro 请求换模型计费,是两件事。原来调用 Pro 的开发者,也要留意切换后的实际效果。
新版能力怎样?
内测通知提到新的模型结构和原生多模态支持。Reddit 上开发者们的评价,速度很快,能力也有提升。
2. 价格背后,还得有算力和工程投入
很多人一直比较纳闷,为啥 DeepSeek 能把价格打的这么低?
这就不得不提到算力和工程投入两个方面。
国产 AI 公司一直受制于算力,现在解决算力的问题,基本都是部分自建 + 算力租赁,但是 DeepSeek 自己很早就囤了不少卡,加上之前 500 亿融资,有很大部分投入在自建算力扩张上。
最新动作,DeepSeek 已经在内蒙古乌兰察布扩充算力基础设施,既建设自有设施,也向其他公司租赁额外容量。
所以 DeepSeek 自己算力上在国产相对来说是比较充足的,所以才有底气把价格打这么低。
自建意味着要自己承担建设和运维投入。能不能摊薄成本,还要看设施能否按期投入使用,以及机器的利用率,这是一个长期投入与成本计算问题。
要让模型持续服务更多用户,除了准备机器,还得有人做调度,维护系统,提高资源使用效率。
3. 150 个名额,核心是 Agent 相关岗位
另一条消息:DeepSeek 最近大规模扩招。
9 月 7 号晚上,DeepSeek 的 Harness 团队负责人公开招人,一次放出约 150 个名额,其中核心是 Agent 相关。
还记得我之前就说过的么?
现如今的局势,再也不是单纯大模型能力单一维度的竞争了,模型能力 + Agent 才是最重要。
DeepSeek 模型能力其实挺强的,但是 Agent 能力是短板。
之前推出 DeepSeek harness 框架的时候,推出了一个 Web 版 Agent。
我当时就说了,Web 版 Agent 是开发、适配相对最容易的,但是真正的旗舰级 Agent 一定是桌面版和 cli,这才是真正的生产力,但相应的,如果要保证用户体验很好的话,需要投入的资源和精力也更大。
但是很显然,DeepSeek 内部的 Agent 团队缺人,这次扩招就是在补齐这个短板。
未来,DeepSeek 一定会投入更多资源在 Agent 产品开发上,大家不要着急,给它更多时间。
现阶段,大家如果要用 DeepSeek 的话,我真心建议结合 Codex 使用,具体无侵入式使用 DeepSeek 翻我之前的文章。
4. 除了模型 + Agent,多模态才是未来
很多人不理解什么是多模态,这里简单科普下。
早期的模型基本都是文本模型,就是只能识别文字以及输出文字,但是现如今基本都是可以识别图片,视频了。
但是多模态分识别和生成。
啥意思?现在大家听说过的 DeepSeek、Opus、GPT-6 算是多模态识别模型,只能看得懂,但是没法生图,生视频。
这里有人可能会问,你扯淡,我明明用 Opus、GPT-6 可以生图的。
这里的生图,其实是 Codex、Claude Code 这类 Agent 结合模型的前端能力,用代码生成的图片,你可以理解为是画画,是素描。
但真正的多模态生图是拍照,现实什么样就拍成什么样。
目前生成多模态模型就是 Codex、Grok、Gemini 家族,他们家都有图片,视频生成模型,只不过 OpenAI 关闭了自家的视频生成模型。
而目前公认全球最屌的生图模型就是 GPT-Image-2,今天又新发布了 GPT-Image-2.5,又有了大幅提升。
现如今,每个人用 AI 单纯编程模型其实是不够用的,一定要生图,生视频。
5. Codex 当下就是最优选
如果你认同前面我说的:模型 + Agent + 多模态,那么当下就是 Codex 最强。
GPT-6-Astra 的综合能力,尤其是前端能力大大加强,用过基本就不想用其他系列了。
很多人不知道的是,你现在用 GPT-6-Astra 直接做网站,做 ppt 非常好用,OpenAI 前一阵收购了一家专门做 ppt 的公司,所以这决定了现在生成 ppt 的能力非常强,所以现如今,你们可以放弃任何 ppt 所谓的 skill 和工具了。
但是也有一些问题,比如额度不够用,比如一些指令需要反复确认,出活稳定性相对较差些。
不过要知道这才只是大版本 6 的第一个版本,之后 6.1、6.2 优化之后,一切都不是问题,只会不断加强。
而结合最新的 GPT-Image-2.5,基本可以说覆盖绝大部分场景了,除了视频生成,目前依然是 Seedance 2.5 和 MiniMax H3 系列,不过视频能力 OpenAI 一直有,取决于他们什么时候重新投入这块。
真心的给大家一个建议,无论如何,想办法用上 Codex,不管是模型能力还是 Agent,还是多模态能力,都是顶尖的,再加上赛博义父老是重置,性价比也非常高。
我最近复盘,就是两个月前,把我们团队内部所有的主力从 Claude Code 全部迁移到了 Codex,现在想想,是绝对最正确的决定。
现如今我们内部的很多工具和产品,都需要多模态能力,完全 AI 代码生成的视频,一个比一个好,这都是基于 OpenAI 这三个维度的提升。
所以我看 DeepSeek 这次扩招,最期待的就是,它能把模型能力变成更成熟的 Agent 产品,再把多模态生成能力接进来。价格已经有吸引力,接下来还得让人用得顺手。
6. 有人如果想转型 AI 岗位
很多人会关心这么一个问题,说现在学 AI 晚不?如何转型 AI 岗?
我只能今年是全新的 Agent 时代,是元年,一切才刚开始。
AI 岗位的人才缺口很大,如果你想转型 AI,可以参考这份 AI 岗位地图,我专门给所有球友做了详细的拆分,写了两篇 AI 底层能力学习地图和人才岗位需求,每个人对应自己未来定位,根据星球教程去一步步学就好,只要你用心投入时间,拿出魄力,三个月后找到一份 AI 相关工作,完全不是问题。
这里也把这两张地图放出来,给非球友的公号读者参考。
最后,再说一句,我真心认为,不管你信不信,我都认为,AI 时代一切才刚开始。