过去两天无实质发布:一手渠道里没有任何厂商发布新模型或新 API,官方博客只有 OpenAI 一篇客户案例和 Google 一篇 OLMo 3 复现工程稿。真正值得看的都在框架 PR 里:Qwen4Exp、DeepSeek V4.1 VL、Kimi-K3、GLM-5.3 的适配工作在同步推进,说明下一波开源旗舰已在路上。
无。今日抓到的官方渠道条目均非模型发布:OpenAI 的 Proaction 客户案例只是以已上线产品口吻提及 Codex、GPT-Live-1 与 GPT-6 Astra;Google Developers Blog 的 OLMo 3 7B 复现是 MaxText/TPU 训练工程文章,复现的是 AI2 已有模型,不是新权重。
今天没有可以直接拿来试的东西,但信号密度不低。最值得跟进的是 Qwen4Exp:三个框架同时在做同一套 GDN + PLE 结构的 kernel 融合与投机解码,这种深度适配通常领先正式发布几周,而 PLE 冷页 readahead 意味着 Qwen4 可能把逐层嵌入放到 checkpoint 里按需读取,对本地部署的显存占用是好消息。DeepSeek V4.1 VL 和 Kimi-K3 处于同一阶段,若你在等国产开源多模态或长文本旗舰,这两条线可以开始预留评测计划。GLM、MiniMax 的 PR 是 ROCm 路径和融合路由的修修补补,DeepSeek-OCR-2、Roberta reranker LoRA、Granite 文档更新都是常规生态噪音。V4.1-Flash"便宜 70%"的说法只有二手来源,先别据此调整选型,等官方定价页。Google 那篇 OLMo 3 复现对训练基础设施团队是一篇好的工程参考(MFU、mid-flight 换芯片、checkpoint 精确重放),和模型选型无关。
| 时间 | 通道 | 条目 |
|---|---|---|
| 09-26 03:00 | OpenAI News | Proaction boosts sales 60% and saves 75+ hours with Codex |
| — | Google Developers Blog | Reproducing OLMo 3 7B Pre-training in MaxText: case study of large scale training on TPUs |
| 时间 | 通道 | 条目 |
|---|---|---|
| 09-27 15:37 | 媒体转述 | 浙江经济职业技术学院网络安全团队参与研发的“方研”大模型在数贸会发布 - 中国教育在线 |
| 09-27 13:47 | 媒体转述 | DeepSeek V4.1-Flash Pricing: 70% Cheaper, Beats Opus 5 - shattered.io |
| 09-27 03:34 | 媒体转述 | 大模型价格战持续升温,智谱市值跌至3000亿港元 - 观察者网 |
| 09-26 03:21 | 媒体转述 | Gemini 4 Nears Launch as Google Trails by 17 Points [2026] - tech-insider.org |
modelwatch/modelwatch.py 自动生成。ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。