今天 AI 圈炸了四次:GPT-6 家族补齐、小米开源登顶、Grok 4.7 最强编码、Claude 缓存再降价

0 阅读6分钟

今天 AI 圈炸了四次:GPT-6 家族补齐、小米开源登顶、Grok 4.7 最强编码、Claude 缓存再降价

今天(9 月 23 日)AI 圈热闹得有点不寻常。

OpenAI 补齐 GPT-6 家族,小米开源模型登顶全球榜首,SpaceXAI 发布最强编码模型,Anthropic 大幅下调缓存价格——四件大事挤在同一天。

这不是巧合。 2026 年下半年,AI 竞争的主战场已经从「谁的模型更聪明」变成了「谁的成本更低、谁的开源更狠、谁的垂直能力更强」。


一、OpenAI 发布 GPT-6 Sol 与 Luna,API 价格永久降 50%

OpenAI 正式补齐 GPT-6 家族阵容,发布中端模型 GPT-6 Sol 和轻量模型 GPT-6 Luna。加上月初发布的旗舰 GPT-6 Astra,三档阵容成型。

据 Sam Altman 和产品负责人 Tibo 在 X 上宣布,Sol 和 Luna 在智能、对齐、编码和电脑操作等方面比 5.6 系列有重大改进,API 价格永久降低 50% 。

模型输入 / 百万 token输出 / 百万 token
GPT-6 Astra$10.00$50.00
GPT-6 Sol$5.00$15.00
GPT-6 Luna$0.50$1.50
GPT-5.6 Sol(原价)$5.00$30.00

对比 GPT-5.6 Sol 原价,GPT-6 Sol 输出价格降了 50%。Luna 的价格更是低至 Astra 的二十分之一。

核心信号: OpenAI 在用三档定价覆盖全场景。Luna 用来抢高频低难度调用市场,Sol 卡中端性价比,Astra 守高端。价格永久降价不是促销——是战略。

Plus、Pro 和 Business 用户还将获得一次「banked reset」用量重置。


二、小米 MiMo-V2.6 开源发布,登顶全球开源模型榜首

9 月 22 日,小米正式发布并开源 MiMo-V2.6 系列大模型,包含旗舰 MiMo-V2.6-Pro 和高效 MiMo-V2.6-Flash。

MiMo-V2.6-Pro 在 AA 综合智能指数 v4.3.2 中取得 46 分,超越 Kimi K3(44 分)和 GLM-5.3(45 分),成为当前排名最高的开源权重模型,较上一代提升 20 分。

几个关键数据:

  • 全模态能力: 同时处理文本、图像、视频和音频
  • 3D 空间推理与多模态感知: 支持机械臂视觉闭环控制
  • Lean 4 形式化证明: 完成了「周期三蕴含混沌」定理的完整证明(6000 余行代码)
  • 训练成本: Pro 约 262 万美元,Flash 约 85 万美元
  • API 价格不变: Pro 输入 3 元 / 输出 6 元;Flash 输入 1 元 / 输出 2 元

小米同时开源了模型权重、技术报告、7k+ RL 任务环境及端到端训练框架。

核心信号: 小米用 RSI(递归自我改进)路径做开源,不是「阉割版开源」,而是连训练框架一起给。262 万美元训练成本公开透明,对闭源厂商的定价体系是直接冲击。


三、SpaceXAI 发布 Grok 4.7,主打编码与知识工作

9 月 21 日,SpaceXAI 发布 Grok 4.7,官方称其为目前最强的编码和知识处理模型。采用更大的基础架构,通过更长时间的强化学习训练提升复杂任务处理能力。

定价维持与 Grok 4.6 相同:输入 2/输出2 / 输出 2/输出6 每百万 token。SpaceXAI 宣称速度是同类模型的两倍,价格却只有一半。

基准Grok 4.7Grok 4.6提升
CursorBench 4.046.3%40.4%+5.9pp
DeepSWE v1.171.0%—接近 GPT-5.6 Sol 的 72.7%
Terminal-Bench 4.038.0%20.3%+17.7pp

其他亮点:

  • 原生理解 Grok Bot 智能体框架,更好支持对话式任务
  • 全新安全架构: 在拒绝危险请求和抵御越狱攻击方面表现最强

Grok 4.7 已上线 Cursor、Grok Build 编码助手及 API。

核心信号: SpaceXAI 在编码垂直领域打差异化。编码市场正在成为 AI 厂商的核心战场——编码场景有明确的评测标准、有付费意愿强的用户群体、有可验证的效果反馈。


四、Anthropic 调整定价:Sonnet 5 不涨价,Fable 5.1 缓存降价 75%

Anthropic 宣布两项重要定价调整。

第一,Sonnet 5 促销价转正。 Claude Sonnet 5 的促销价(输入 2/输出2 / 输出 2/输出10 每百万 token)已成为标准价格,原定 9 月 1 日涨至 3/3/3/15 的计划取消。

第二,Fable 5.1 缓存读取降价 75%。 从 1降至∗∗1 降至 1降至∗∗0.25 每百万 token。据 Anthropic 估算,典型工作负载成本降低约 25%,高度智能体化的工作负载降低约 45%。

模型输入 / 百万 token输出 / 百万 token缓存读取 / 百万 token
Claude Sonnet 5$2$10—
Claude Fable 5.1$10$500.25(原0.25(原 0.25(原1)

核心信号: Anthropic 不涨价等于隐性降价。缓存降价 75% 直接命中 Agent 场景的成本痛点——长上下文、高频调用中的冗余 Token 是成本大头。谁把缓存做好,谁就在 Agent 经济中获得结构性优势。


五、四件事放一起看:2026 下半年 AI 竞争的三条新战线

把今天的四件大事放一起,趋势非常清晰。

第一条战线:价格战全面打响。 OpenAI 永久降 50%,Anthropic 缓存降 75%,Grok 4.7 同价更猛。头部模型的价格正在快速下降,对开发者是实打实的好事。

第二条战线:开源对闭源的正面冲击。 小米 MiMo-V2.6-Pro 以 46 分登顶开源榜首,训练成本透明、框架全开源。开源模型和闭源模型的差距正在快速缩小。

第三条战线:垂直能力差异化。 Grok 4.7 不拼全能拼编码,Cursor 推「项目」功能拼长周期开发。当全能模型能力过剩时,垂直场景的深度优化正在成为新的竞争维度。

对开发者来说,这意味着什么?

  • 选模型不能只看 benchmark 了,价格结构(缓存、输入、输出)才是月度账单的决定因素
  • 开源模型已经可以打,别忽视小米、Kimi、GLM 这些中国厂商
  • 编码场景有新选择,Grok 4.7 值得试一试,DeepSWE 71% 已经接近 GPT-5.6 Sol
  • Agent 开发的成本门槛在快速下降,缓存降价 75% 是实质性的

写在最后

2026 年下半年,AI 竞争的主战场已经不在「能力」上。

当头部模型都强到「过剩」的时候,价格、开源、垂直能力成了新的竞争维度。这对开发者是好消息——选择更多、成本更低、工具更丰富。

你今天最关注哪条新闻?选模型时最看重什么?评论区聊聊。


参考来源