大模型发布监控28 条
2026-09-07回看 2 天 · 新增 28 条(媒体 12,框架 12,官方 3,权重 1)
⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(349 天前)
一句话总览
今天真正坐实的新权重只有智谱 GLM-5.3-Flash;被刷屏的"OpenAI GPT-6 Astra / Jensen Huang 宣称 AGI 已到来"目前只有大量媒体转述,没有一条来自 OpenAI 官方博客或 release notes 的独立证实。
正式发布
- 智谱(Zhipu/Z.ai) · GLM-5.3-Flash · 权重已上线,官方尚未发文 —— HF 仓库 zai-org/GLM-5.3-Flash 建仓于 2026-08-25,今日仍在更新,likes 2123、downloads 78.4 万,属于已经跑出真实使用量的正式权重(非测试用小模型)。标签显示为 image-text-to-text 多模态对话模型,同时框架侧(vLLM)今天有 5 个 PR 在做 GLM-5.3-Flash 的性能适配(NoPE/KDA 稀疏 prefill、投机解码 DFlash2、视频占位符时间戳修复等),属于发布后的生态补齐,细节(参数量/上下文/定价)待官方补充。 来源
早期信号
- 疑似 DeepSeek-V4 正在训练/推理中:vLLM 今天有 2 个 PR 在修 DeepSeek-V4 的 cache_utils Triton kernel 越界读取、ROCm 稀疏 prefill 边界情况,但 HF 上未见官方同版本权重,说明模型可能仍在内测或临近发布。 来源
- 疑似 Gemma4(26B-A4B MoE 架构) 在做适配:vLLM 为 Transformers backend 启用 QKV-Fuser,llama.cpp 在调 flash attention 性能,但 HF 无官方权重,尚未正式发布。 来源
- 疑似 Qwen3.5/Qwen3.8(27B 级混合 GDN 架构) 正在开发中:vLLM 有一个 WIP PR 涉及 Hybrid GDN + MTP 投机解码的并发修复,HF 无官方权重,属早期代码级信号。 来源
- 疑似新模型 XingChen4(MoE,复用 DeepSeek-V2/V3 骨架 + 新提出的 mHC 残差连接机制):vLLM 收到一个明确标注"upcoming"的模型支持 PR,作者说明权重尚未在 HF 公开,等权重放出后才会转正,是目前信号最明确的"未发布"条目。 来源
媒体转述(二手)
- 据多家外媒(Washington Examiner、The Times of India、Investing.com、新浪财经等)报道,OpenAI 发布了新模型 "GPT-6 Astra",英伟达 CEO 黄仁勋发文称"AGI 已经到来",但截至目前 OpenAI 官方渠道未见对应的发布博客,真实性和规格均待官方确认。
- 据 shattered.io 报道,"Grok 4.5" 以 2/6 美元的输入/输出定价对外宣传,称价格低于 GPT-5 与 Claude,未见 xAI 官方通稿佐证。
- 据智源社区报道,有传言称某中东资方发布的"纯血"大模型底座实为 MiniMax,为未经证实的行业八卦。
- 据 Memeburn 报道,过去六周内多家厂商密集发布模型(从 Kimi K3 到所谓 "GPT-6 Astra"),属于综述型二手汇总。
判断
今天唯一值得实际跟进的是 GLM-5.3-Flash——权重已上线且用量可观,多模态对话方向,如果做模型选型评估可以纳入候选池。铺天盖地的 "GPT-6 Astra / AGI 已到来" 目前全是媒体二手转述和黄仁勋的场面话,没有 OpenAI 官方一手证据,先当噪音处理,等官方博客或 API/HF 权重出现再确认。DeepSeek-V4、Gemma4、Qwen3.5/3.8、XingChen4 这几条框架 PR 信号值得记下来蹲后续,其中 XingChen4 的 mHC 残差架构设计比较新颖,可以关注它权重放出后的评测。
原始条目
■ 官方 (3 条)
■ 权重 (1 条)
■ 框架 (12 条)
■ 媒体 (12 条)