大模型发布监控34 条
2026-08-12回看 2 天 · 新增 34 条(框架 13,媒体 12,官方 8,权重 1)
⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(323 天前)
一句话总览
今天最重要的两件事:OpenAI 把 Daybreak 网络安全系列模型(含 GPT-5.6 Sol 通道)搬进了 AWS Bedrock,Qwen3.5-122B-A10B 等一批新模型登陆 SageMaker JumpStart;同时框架侧出现 DeepSeek-V4、Kimi-K3、MiniMax-M3、GLM-5.2 等一大批下一代旗舰的密集适配信号,"下一波发布潮"正在路上。
正式发布
- OpenAI · Daybreak Blue / Red · 2026-08-11 —— OpenAI 官宣其网络安全方向的 Daybreak 能力体系上线 Amazon Bedrock:Daybreak Blue 提供带防御性安全护栏的前沿通用模型(含 GPT-5.6 Sol),Daybreak Red 是面向授权漏洞研究、exploit 验证与渗透测试的专训安全模型。需先通过 Daybreak Access 资格审核,经 Bedrock 控制台或 Responses API(bedrock-mantle 端点)调用。这是继 Codex 上 AWS 之后 OpenAI 与 AWS 合作的又一步,把"红队专用模型"正式推向企业采购通道。来源
- Qwen · Qwen3.5-122B-A10B / Qwen-AgentWorld-35B-A3B · 2026-08-11(SageMaker JumpStart 上架) —— AWS 官方公告三个新模型上架 JumpStart,最重的是 Qwen3.5-122B-A10B:122B 总参数、每 token 仅激活 10B,Gated Delta Networks 与稀疏 MoE(256 专家)混合架构,原生 262K 上下文,主打多模态推理、代码与 agent。同场的 Qwen-AgentWorld-35B-A3B 是"语言世界模型",在 1000 万条真实交互轨迹上训练,可在工具调用/终端/软工/Android/Web 等 7 类 agent 环境里预测下一步环境状态;另有 NVIDIA 的视觉定位小模型 LocateAnything-3B。注意:vLLM/llama.cpp 侧同日仍在推进 Qwen3.5 支持,属发布后的生态补齐。来源
- NVIDIA · Nemotron 3.5 Lightning · 2026-08-11(SageMaker JumpStart 上架) —— AWS 官方公告该模型已可在 JumpStart 部署。公告正文抓取不全,参数规格与定位细节待官方补充。来源
- Mistral · 区域推理端点与开放模型扩展 · 2026-08-11 —— 官方博文宣布面向"主权 AI"的一揽子动作:新增区域内推理端点与优先级档位、扩大开放模型可获取范围,并牵头组建欧洲算力联盟,计划到 2030 年建成最高 1 GW 容量。属平台与 API 侧变动而非新模型,但会影响欧洲合规场景的选型。来源
- Microsoft · Fara-7B 更新 · 2026-08-12 —— HF 仓库当日有实质内容更新(权重已上线,官方尚未发文)。标签显示这是基于 qwen2_5_vl 架构的 7B 图文多模态对话模型;仓库 2025-10-30 就已建好,本次更新可能对应一次版本刷新,具体变更待官方说明。来源
- Google DeepMind · 手语 AI 落地 · 2026-08-12 —— 官方博文宣布将手语 AI 交付到用户手中,属无障碍方向的专用模型应用而非基座模型发布,正文抓取不全,细节待官方补充。来源
早期信号
- vLLM 出现两个 DeepSeek-V4 专属 PR(e8m0 专家量化表示、ROCm 融合 mega-MoE 后端),HF 上尚无官方同版本权重——疑似 DeepSeek 下一代旗舰正在做发布前适配。
- Kimi 侧双线信号:vLLM 在为 Kimi-K3 加 MTP 投机解码草稿配置(AMD 平台、TP4/DP2/EP8 起服测试已跑通),另有 Kimi K2.5 / K2.6 的 MXFP4 MLA 后端修复;两者 HF 均无官方权重,疑似未发布或闭源 API 版本。
- vLLM 三个 PR 在修 MiniMax-M3 的 WideEP DP16 分布式同步与 MXFP4 推理,HF 无官方权重——疑似 MiniMax 下一代 MoE 在做规模化部署准备。
- vLLM 在打通 GLM-5.2(GlmMoeDsaForCausalLM,走 DeepSeek-V3.2 稀疏注意力路径、MXFP4)并修复 GLM-OCR / GLM4-MoE-Lite 的 MTP CUDA graph 问题,HF 均无官方权重——疑似智谱新一代主力及配套模型在适配中。
- transformers 有 PR 在为 Meta「MuseGlimmer」补 DFlash 投机解码与张量并行支持,结合媒体所称 Meta 开源 30B 模型的说法,疑似该模型已发或临近发布,但本次抓取中未见官方博文佐证。
- transformers 出现新架构 Lumma(FrontiersMind 出品)的原生支持 PR:Llama 风格解码器加分解式嵌入、共享 KV 注意力、可选层共享等省参设计——疑似一家新玩家的效率型模型在铺路。
媒体转述(二手)
- 据 CSDN 博客转述,Meta 开源 30B 大模型 Muse Glimmer,扎克伯格同时发长文抨击 AI 权力集中。
- 据新浪财经报道,蚂蚁基于 Kimi 开源了一款新模型。
- 据财联社报道,英伟达被曝正在开发万亿参数的开源 AI 模型。
- 据 NDTV Profit 等多家媒体报道,SpaceX AI 与 Cursor 以 beta 形式推出"AI 队友"Grok Bot。
判断
值得动手跟的是两条:一是 Daybreak Red/Blue 进 Bedrock——授权攻防场景的专训模型第一次有了主流云上的正规采购路径,做安全的团队应该去申请资格试一轮;二是 Qwen3.5-122B-A10B,10B 激活加 262K 原生上下文的规格对自托管推理很有吸引力,等 HF 权重和 vLLM 支持齐了就能上机评估。真正的大戏在早期信号里:DeepSeek-V4、Kimi-K3、MiniMax-M3、GLM-5.2 四家的下一代同时在框架里冒头,接下来两三周盯紧 HF 官方组织即可。Fara-7B 更新、Nemotron 上架属常规动作,Grok Bot 一类消息是产品营销层面的噪音,不影响选型。
原始条目
■ 官方 (8 条)
■ 权重 (1 条)
■ 框架 (13 条)
■ 媒体 (12 条)