今天 AI 圈炸了四次:GPT-6 家族补齐、小米开源登顶、Grok 4.7 最强编码、Claude 缓存再降价
今天(9 月 23 日)AI 圈热闹得有点不寻常。
OpenAI 补齐 GPT-6 家族,小米开源模型登顶全球榜首,SpaceXAI 发布最强编码模型,Anthropic 大幅下调缓存价格——四件大事挤在同一天。
这不是巧合。 2026 年下半年,AI 竞争的主战场已经从「谁的模型更聪明」变成了「谁的成本更低、谁的开源更狠、谁的垂直能力更强」。
一、OpenAI 发布 GPT-6 Sol 与 Luna,API 价格永久降 50%
OpenAI 正式补齐 GPT-6 家族阵容,发布中端模型 GPT-6 Sol 和轻量模型 GPT-6 Luna。加上月初发布的旗舰 GPT-6 Astra,三档阵容成型。
据 Sam Altman 和产品负责人 Tibo 在 X 上宣布,Sol 和 Luna 在智能、对齐、编码和电脑操作等方面比 5.6 系列有重大改进,API 价格永久降低 50% 。
| 模型 | 输入 / 百万 token | 输出 / 百万 token |
|---|---|---|
| GPT-6 Astra | $10.00 | $50.00 |
| GPT-6 Sol | $5.00 | $15.00 |
| GPT-6 Luna | $0.50 | $1.50 |
| GPT-5.6 Sol(原价) | $5.00 | $30.00 |
对比 GPT-5.6 Sol 原价,GPT-6 Sol 输出价格降了 50%。Luna 的价格更是低至 Astra 的二十分之一。
核心信号: OpenAI 在用三档定价覆盖全场景。Luna 用来抢高频低难度调用市场,Sol 卡中端性价比,Astra 守高端。价格永久降价不是促销——是战略。
Plus、Pro 和 Business 用户还将获得一次「banked reset」用量重置。
二、小米 MiMo-V2.6 开源发布,登顶全球开源模型榜首
9 月 22 日,小米正式发布并开源 MiMo-V2.6 系列大模型,包含旗舰 MiMo-V2.6-Pro 和高效 MiMo-V2.6-Flash。
MiMo-V2.6-Pro 在 AA 综合智能指数 v4.3.2 中取得 46 分,超越 Kimi K3(44 分)和 GLM-5.3(45 分),成为当前排名最高的开源权重模型,较上一代提升 20 分。
几个关键数据:
- 全模态能力: 同时处理文本、图像、视频和音频
- 3D 空间推理与多模态感知: 支持机械臂视觉闭环控制
- Lean 4 形式化证明: 完成了「周期三蕴含混沌」定理的完整证明(6000 余行代码)
- 训练成本: Pro 约 262 万美元,Flash 约 85 万美元
- API 价格不变: Pro 输入 3 元 / 输出 6 元;Flash 输入 1 元 / 输出 2 元
小米同时开源了模型权重、技术报告、7k+ RL 任务环境及端到端训练框架。
核心信号: 小米用 RSI(递归自我改进)路径做开源,不是「阉割版开源」,而是连训练框架一起给。262 万美元训练成本公开透明,对闭源厂商的定价体系是直接冲击。
三、SpaceXAI 发布 Grok 4.7,主打编码与知识工作
9 月 21 日,SpaceXAI 发布 Grok 4.7,官方称其为目前最强的编码和知识处理模型。采用更大的基础架构,通过更长时间的强化学习训练提升复杂任务处理能力。
定价维持与 Grok 4.6 相同:输入 2/输出2 / 输出 2/输出6 每百万 token。SpaceXAI 宣称速度是同类模型的两倍,价格却只有一半。
| 基准 | Grok 4.7 | Grok 4.6 | 提升 |
|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | +5.9pp |
| DeepSWE v1.1 | 71.0% | — | 接近 GPT-5.6 Sol 的 72.7% |
| Terminal-Bench 4.0 | 38.0% | 20.3% | +17.7pp |
其他亮点:
- 原生理解 Grok Bot 智能体框架,更好支持对话式任务
- 全新安全架构: 在拒绝危险请求和抵御越狱攻击方面表现最强
Grok 4.7 已上线 Cursor、Grok Build 编码助手及 API。
核心信号: SpaceXAI 在编码垂直领域打差异化。编码市场正在成为 AI 厂商的核心战场——编码场景有明确的评测标准、有付费意愿强的用户群体、有可验证的效果反馈。
四、Anthropic 调整定价:Sonnet 5 不涨价,Fable 5.1 缓存降价 75%
Anthropic 宣布两项重要定价调整。
第一,Sonnet 5 促销价转正。 Claude Sonnet 5 的促销价(输入 2/输出2 / 输出 2/输出10 每百万 token)已成为标准价格,原定 9 月 1 日涨至 3/3/3/15 的计划取消。
第二,Fable 5.1 缓存读取降价 75%。 从 1降至∗∗1 降至 1降至∗∗0.25 每百万 token。据 Anthropic 估算,典型工作负载成本降低约 25%,高度智能体化的工作负载降低约 45%。
| 模型 | 输入 / 百万 token | 输出 / 百万 token | 缓存读取 / 百万 token |
|---|---|---|---|
| Claude Sonnet 5 | $2 | $10 | — |
| Claude Fable 5.1 | $10 | $50 | 0.25(原0.25(原 0.25(原1) |
核心信号: Anthropic 不涨价等于隐性降价。缓存降价 75% 直接命中 Agent 场景的成本痛点——长上下文、高频调用中的冗余 Token 是成本大头。谁把缓存做好,谁就在 Agent 经济中获得结构性优势。
五、四件事放一起看:2026 下半年 AI 竞争的三条新战线
把今天的四件大事放一起,趋势非常清晰。
第一条战线:价格战全面打响。 OpenAI 永久降 50%,Anthropic 缓存降 75%,Grok 4.7 同价更猛。头部模型的价格正在快速下降,对开发者是实打实的好事。
第二条战线:开源对闭源的正面冲击。 小米 MiMo-V2.6-Pro 以 46 分登顶开源榜首,训练成本透明、框架全开源。开源模型和闭源模型的差距正在快速缩小。
第三条战线:垂直能力差异化。 Grok 4.7 不拼全能拼编码,Cursor 推「项目」功能拼长周期开发。当全能模型能力过剩时,垂直场景的深度优化正在成为新的竞争维度。
对开发者来说,这意味着什么?
- 选模型不能只看 benchmark 了,价格结构(缓存、输入、输出)才是月度账单的决定因素
- 开源模型已经可以打,别忽视小米、Kimi、GLM 这些中国厂商
- 编码场景有新选择,Grok 4.7 值得试一试,DeepSWE 71% 已经接近 GPT-5.6 Sol
- Agent 开发的成本门槛在快速下降,缓存降价 75% 是实质性的
写在最后
2026 年下半年,AI 竞争的主战场已经不在「能力」上。
当头部模型都强到「过剩」的时候,价格、开源、垂直能力成了新的竞争维度。这对开发者是好消息——选择更多、成本更低、工具更丰富。
你今天最关注哪条新闻?选模型时最看重什么?评论区聊聊。
参考来源
- 网易新闻:OpenAI 发布 GPT-6 Sol 与 Luna,价格减半 — GPT-6 家族三档定价详情
- IT之家:小米 MiMo-V2.6 发布,登顶开源榜首 — MiMo-V2.6-Pro 与 Flash 版本细节
- Unite.ai: SpaceXAI Releases Grok 4.7 — Grok 4.7 编码基准与安全架构
- Anthropic 官方定价页 — Sonnet 5 转正与 Fable 5.1 缓存降价
- Cursor 官方公告 — 项目功能上线说明
- 每一天都有倪-公众号AI日报