大模型发布监控39 条
2026-09-04回看 2 天 · 新增 39 条(框架 15,媒体 12,官方 8,权重 4)
⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(346 天前)
一句话总览
今天最大的事是 OpenAI 正式发布 GPT-6 Astra(首个达到"关键级"网络安全能力的模型),同时 Google 发布 Gemini 3.8 Flash / Flash Cyber,两家都在强调网络安全能力;智谱 GLM-5.3 系列权重疑似已随 Coding Plan 活动上线但官方博客未见。
正式发布
- OpenAI · GPT-6 Astra · 2026-09-03 —— OpenAI 官方安全说明确认发布,称其为"迄今为止最强大的广泛部署模型",是首个在 Preparedness Framework 下达到"Critical"级网络安全能力的模型(能在无人逐步引导的情况下发现未知安全漏洞并开发利用方式)。官方同步强化了越狱鲁棒性、对齐训练和滥用监控措施,并公布客户案例(Legora 法律文档审查提速40%、Playco 游戏原型开发减少50%人工修复)。细节待官方补充(未提供参数量/上下文/定价)。来源
- Google DeepMind · Gemini 3.8 Flash / 3.8 Flash Cyber · 2026-09-03 —— 官方博客确认发布,Flash Cyber 是面向网络安全场景的变体,与 OpenAI Daybreak 类似方向呼应了"防御方窗口期"话题。据媒体转述定价约 $0.75/百万输入 token(未经官方博客直接证实,需谨慎对待)。细节待官方补充。来源
- 智谱 Z.ai · GLM-5.3 / GLM-5.3-Flash · 权重已上线,官方尚未发文 —— HF 仓库 GLM-5.3(glm_moe_dsa 架构)与 GLM-5.3-Flash(glm5_next 架构,多模态 image-text-to-text)均在 2026-09-04 更新,下载量已达 30万/65万级别,说明已实质发布并被广泛使用;同时 Z.ai 文档公布了 GLM-5.3-Flash 使用活动(9/3-9/20,通过 ZCode 免费或双倍额度),侧面印证该模型已上线服务。来源
早期信号
- vllm PR 显示正在做 "GLM5.2/5.3 de-JITification" 性能优化,HF 上未见对应官方权重,疑似还有后续 GLM-5.x 版本或部署形态在路上。
- vllm 多个 PR 出现 "Qwen3.8-Flash-Next" 字样(融合 PLE 残差、移除 torch.compile 适配),HF 上无对应权重,疑似 Qwen 下一代 Flash 系列正在框架侧预适配。
- vllm PR 提到 "Kimi K3 nvfp4" 权重对齐优化,以及 MegaMoE 后端新增对 DeepSeek V4、Kimi K3 的 NVFP4 checkpoint 支持,疑似这两款模型的量化部署形态还在推进。
- vllm 出现 "MiniMax-M3" decode 性能调优 PR,HF 上无官方权重,疑似 MiniMax 下一代模型在测试中。
- InclusionAI 的 Ling-3.0-flash 与 Ling-3.0-tiny 在 HF 上均于今日有更新(建仓早于今日),下载量已有一定规模,疑似已小范围发布但未见官方博客确认。
媒体转述(二手)
- 据多家媒体(Anadolu Ajansı、Finextra、Silicon Republic、爱范儿等)报道,GPT-6 Astra 发布引发"AGI 时刻"讨论,部分评论认为其能力"强到难以理解或控制",但这类标题多为渲染,应以 OpenAI 官方安全说明为准。
判断
GPT-6 Astra 是今天唯一值得认真跟进的旗舰发布——网络安全能力跃升到"Critical"级别,对代码审计/漏洞挖掘类工作流是直接利好,但也意味着需要关注其使用政策和风控边界。Gemini 3.8 Flash 系列是常规迭代加安全变体,可关注定价但不算颠覆性。GLM-5.3 权重已实质可用,值得实测但优先级低于 Astra。其余框架 PR 里的 Qwen3.8-Flash-Next、GLM 后续版本、MiniMax-M3 均属早期信号,暂不必投入验证成本。
原始条目
■ 官方 (8 条)
■ 权重 (4 条)
■ 框架 (15 条)
■ 媒体 (12 条)