🎬 视频版直达:www.bilibili.com/video/av117…
💡 今日趋势速览:社区观察到Arena竞技场疑似出现新的Kimi K3检查点,OpenCode同步上线归属智谱的匿名模型Omen Alpha,两者均未获官方认领。与此同时OpenAI更新计费规则,GPT-6 Astra在Codex中支持105万Token上下文且免除长上下文加价。多款神秘模型接连现身,厂商谍战式预热正成为新模型发布的主流打法。
🎯 今日要点
- Arena 竞技场疑现新 Kimi K3 检查点
- OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价
- OpenCode 上线神秘模型 Omen Alpha,疑为智谱 GLM 新品
📋 今日内容汇总
🤖 AI动态
- Arena 竞技场疑现新 Kimi K3 检查点
- OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价
- OpenCode 上线神秘模型 Omen Alpha,疑为智谱 GLM 新品
- GPT-6 Astra 向 Pro、Enterprise 等用户全面开放,同步上线OpenRouter
- GPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出
- Ling-3.0-flash-VL 发布,新增视觉理解能力
- Viggle 发布首个开放权重模型 Viggle-Animate
- Inclusion AI 发布开源图像模型 LLaDA-Image
- Meta 公开发布 Muse Spark 1.3 Max
- Ling-3.0-flash-Sante 发布:面向医疗的 MoE 模型
- OpenVDN 开源 VDN-H3,视频生成速度超过播放时长
- 腾讯开源 WeMM-Embedding:9B 版登顶 MMEB-v2 榜单
- Qwen3.8-Flash 上线 qwenwork:速度翻倍,自动生成演示文稿
- 谷歌发布音乐生成模型 Lyria 3.5,登陆 Gemini 应用与 API
- 词元星火开源 Spark-X2.5 端侧 Agent 模型
🔌 AI基础设施
🧪 芯片半导体
📌 模型排行榜
🤖 AI动态
社区用户观察到 Arena 竞技场疑似出现新的 Kimi K3 检查点,原帖带 #Kimi 标签。消息为抢先观察爆料,发帖人用词「似乎」,无跑分或官方公告佐证,新检查点的能力变化、开放范围与发布时间均未知,需以官方确认为准。
2. OpenAI 免除 GPT-6 Astra 在 Codex 中的长上下文加价
OpenAI更新计费规则,GPT-6 Astra在Codex中获得特殊豁免,支持105万Token上下文不过优惠仅限Codex,GPT-5.4等其他模型超长上下文仍按原规则加价此外Tibo宣布,付费ChatGPT账户当天没获得Astra访问权限,OpenAI将补偿1次可存储的重置次数,晚一天补1次。
3. OpenCode 上线神秘模型 Omen Alpha,疑为智谱 GLM 新品
OpenCode 上线匿名模型 Omen Alpha,其数据页面将其归入智谱(Zhipu)旗下,但智谱尚未正式认领。这是继 Ox Alpha 之后 9 天内的第二个匿名模型,此前智谱曾以 Ox Alpha 伪装 GLM-5.3-Flash 供用户免费测试。Omen Alpha 仅面向 OpenCode Go 订阅用户开放,月费 10 美元,定价约为 GLM-5.3-Flash 的 1.6 倍。
4. GPT-6 Astra 向 Pro、Enterprise 等用户全面开放,同步上线OpenRouter
来源:原文 | TechMeme (Twitter)
OpenAI 宣布 GPT-6 Astra 向所有 Pro、Enterprise 与 Business Premium 用户开放,并同步上线 ChatGPT Work、Codex 与 API;此前 9to5Mac 报道其已开始向每月 100 美元与 200 美元两档 Pro 订阅客户推送。GPT-6 Astra 进入个人高端订阅与企业层级。此外,GPT-6 Astra 也同步在OpenRouter上线
5. GPT-6 Astra Aeon 与 GPT-Image 2.5 即将推出
GPT-6 Astra 将成为基础旗舰模型。GPT-6 Astra Aeon 是一款长时程变体,专为执行数天甚至数周的任务设计。GPT-Image 2.5 将带来更高质量的生成效果和更快的生成速度。
6. Ling-3.0-flash-VL 发布,新增视觉理解能力
AntLing正式发布Ling-3.0-flash-VL,该模型基于Ling-3.0-flash构建,新增视觉理解与视觉智能体能力。官方称其在视觉感知、STEM推理、文档智能、多模态智能体任务、前端编码及医疗报告解读等方面均有出色表现,多项基准领先Qwen3.8-27B与Gemini等对比模型。
7. Viggle 发布首个开放权重模型 Viggle-Animate
Viggle 推出其首个开放权重模型 Viggle-Animate。该模型基于 MiniMax-H3 构建,只需一张重新绘制的帧即可替换视频中的人物,渲染时无需姿势骨架、遮罩或文字提示。官方称仅需 3 次前向传播、26 秒即可生成 5 秒视频。
8. Inclusion AI 发布开源图像模型 LLaDA-Image
来源:原文 | ModelScope2022
InclusionAI推出LLaDA-Image与加速版LLaDA-Image-Turbo在Qwen-Image-Bench测试中,该模型英文赛道得53.53分,中文赛道得53.38分该模型可生成照片级真实图像、海报与中英双语排版,主干与图像生成均在统一框架下训练,Turbo版支持2至4步快速推理。
9. Meta 公开发布 Muse Spark 1.3 Max
来源:原文 | alexandr_wang
Meta 方面公开发布 Muse Spark 1.3 Max,Alexandr Wang 称新版本在编码和智能体任务上的表现显著增强,即使用过 Muse Spark 1.3 high 或 xhigh 版本也建议重新试用。Muse Spark 1.3 max reasoning 模式现已在 Muse Code 和 Meta Model API 上线,开发者可以直接调用。以下是官方给出的 demo
10. Ling-3.0-flash-Sante 发布:面向医疗的 MoE 模型
AntLingAGI发布Ling-3.0-flash-Sante,这是基于Ling-3.0-flash构建、面向健康与医疗领域增强的MoE模型。其命名源自法语词sante,意为健康,面向真实医疗场景在评测方面,该模型在MedXpertQA-Text、DiagnosisArena-MCQ等基准表现出色,开源模型中处于领先,成绩可比肩旗舰模型。
11. OpenVDN 开源 VDN-H3,视频生成速度超过播放时长
OpenVDN 开源基于 MiniMax-H3 的加速适配版 VDN-H3:混合架构将逐帧线性注意力与保留视觉质量的 Softmax 分支结合,新增注意力分支与两个 LoRA 适配器在推理时合并进 MiniMax-H3。8 步模型在 8 张 B200 上 11.23 秒生成 14.4 秒 768p 视频,速度快于播放时长。以下是官方给出的 demo
12. 腾讯开源 WeMM-Embedding:9B 版登顶 MMEB-v2 榜单
腾讯开源多模态嵌入模型 WeMM-Embedding,提供 2B、4B、9B 三种规模,可同时处理文字、图片、视频及图文混排内容,但不支持音频。9B 版本在 MMEB-v2 榜单排名第一,模型已在 GitHub 上线,许可与商用条款以仓库为准。
13. Qwen3.8-Flash 上线 qwenwork:速度翻倍,自动生成演示文稿
阿里云宣布 Qwen3.8-Flash 在 qwenwork 上线,速度翻倍。输入想法和文件后,它会自动梳理逻辑并生成结构清晰、专业精致的演示文稿。标准模式下 1000 积分约生成 100 份演示文稿,平均每份约 10 积分。以下是官方给出的 demo
14. 谷歌发布音乐生成模型 Lyria 3.5,登陆 Gemini 应用与 API
谷歌发布音乐生成模型 Lyria 3.5,官方称音质最佳,现已登陆 Gemini 应用、AI Studio 与 Gemini API,网页端今日向全球用户开放、应用端数日内推送。新版本人声更具表现力、编曲更丰富,支持选择流派、人声或纯音乐、短曲或长曲及新模板。以下是官方给出的 demo
15. 词元星火开源 Spark-X2.5 端侧 Agent 模型
来源:原文 | GitHubDaily
科大讯飞全资子公司词元星火开源两款端侧模型 Spark-X2.5-1.7B 与 Spark-X2.5-4B,把 Agent 工具调用能力装进小模型。其原生支持 100 万 Token 上下文。按官方评测得分,其多项能力超过同尺寸开源模型,Agent 任务表现尤其突出,打破了 Agent 依赖上百亿参数大模型的惯例。
🔌 AI基础设施
16. 英伟达推出开源个人AI路由器PAIR 让家中多台电脑协同运行本地AI
英伟达在IFA 2026推出开源软件Personal AI Router测试版,它可将AI应用和代理工作流连接到本地端点路由推理。这款虚拟路由器面向本地AI推理,能自动发现局域网内的兼容电脑并汇集闲置算力兼容设备方面,PAIR支持GeForce RTX 20及更新显卡、RTX Pro GPU、DGX Spark与苹果M4以上芯片。
🧪 芯片半导体
17. AMD 发布 Threadripper Halo Station 工作站
来源:原文 | Tom's Hardware
AMD 发布旗舰工作站 Threadripper Halo Station,搭载 Threadripper PRO 9995WX 处理器(Zen5 架构 96 核)与两块 MI350P 加速卡(144GB HBM3E 显存,最多可扩至 4 块),最大支持 2TB 内存。MI350P 单卡功耗最高 600W,博主测算双卡配置用 1650 至 2000W 的 ATX 电源即可带动,似乎可以装进桌面机箱。
IT之家 9 月 4 日消息,摩尔线程在 9 月 3 日半年度业绩说明会上介绍,公司于 2025 年 12 月首届 MUSA 开发者大会发布「花港」架构及高性能图形渲染「庐山」芯片,预计实现 3A 游戏渲染提升 15 倍、AI 性能提升 64 倍、光追性能提升 50 倍。
📌 模型排行榜
19. Artificial Analysis AI 模型能力排行榜
今日大模型双榜:智力榜 Claude Fable 5.1 以 57 分登顶,GPT-6 Astra、Claude Opus 5 以 55、54 分紧随;智能体榜 Fable 5.1 再以 70 分居首,Opus 5 与 Muse Spark 1.3 并列 68 分。开源方面 Kimi K3 智能体榜第 7 名 63 分,Qwen3.8 Max 第 8 名 61 分。
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。