过去两天没有旗舰模型正式落地,真正的头条是 OpenAI 官方发文确认:即将推出的新模型 Astra 在内部评估中无法排除达到 Preparedness Framework 的"Critical"网络安全能力阈值,发布节奏因此放缓。开源侧唯一的新权重是韩国 SKT 的 A.X-K2。
今天真正值得跟进的是 Astra:这是 OpenAI 首次公开表示某模型"无法排除 Critical 网络能力",它既预告了下一代旗舰的能力档位,也可能重塑此后所有前沿模型的发布流程和管控标准——短期内别指望它上线,但相关安全框架动向会影响整个行业。其次是 DeepSeek 的"一软一硬"组合:V4 在 vLLM 已进入性能打磨、同时 API 大幅涨价,两件事叠加意味着其下一代发布临近且低价红利结束,依赖 DeepSeek API 的选型要重新算账。GLM-5.2、Qwen3.5、Kimi-K3、Dots3 全模态四路适配信号说明国产新一波旗舰集中在路上,值得持续盯。A.X-K2 是韩系开源新面孔、架构抄 DeepSeek 作业,可等官方发文后再评估;其余框架 PR 属常规生态补齐,噪音。
| 时间 | 通道 | 条目 |
|---|---|---|
| 08-07 23:20 | OpenAI News | Responding to the next frontier of critical cyber capabilities |
| 时间 | 通道 | 条目 |
|---|---|---|
| 08-08 21:10 | 框架 PR | transformers #47844: Add Dots3-Note Omni model support |
| 08-08 19:13 | 框架 PR | vllm #51498: [Model] Add tower and connector LoRA support for LFM2-VL |
| 08-08 16:25 | 框架 PR | vllm #51493: [Bugfix] Use the V2 model runner for Gemma 4 MoE so MTP drafting works |
| 08-08 15:12 | 框架 PR | llama.cpp #26757: model: Add support for A.X K2 |
| 08-08 15:05 | 框架 PR | kimi3 —— 框架侧 2 个 PR(vllm 2) |
| 08-08 07:23 | 框架 PR | vllm #51461: [MM][CG][BugFix] Fix Ernie-4.5-VL encoder CG postprocess for multi-path outputs |
| 08-08 04:51 | 框架 PR | deepseek —— 框架侧 2 个 PR(vllm 2) |
| 08-08 04:18 | 框架 PR | llama.cpp #26742: model-saver : emit moe latent size for nemotron-h |
| 08-08 02:22 | 框架 PR | vllm #51430: [Perf] Narrow DeepSeek V4 eager CUDA graph region |
| 08-08 01:19 | 框架 PR | vllm #51426: [Rust Frontend] Fix GLM-5.2 chat template rendering parity |
| 08-08 01:11 | 框架 PR | mistral —— 框架侧 2 个 PR(transformers 2) |
| 08-08 00:31 | 框架 PR | qwen3 —— 框架侧 2 个 PR(transformers 1, vllm 1) |
| 08-07 23:47 | 框架 PR | vllm #51416: Add FA4 Dense and MLA |
modelwatch/modelwatch.py 自动生成。ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。