AI 情报站

大模型发布监控27 条

2026-09-06

回看 2 天 · 新增 27 条(框架 18,媒体 8,权重 1)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(348 天前)

一句话总览

今天没有官方一手渠道确认的旗舰模型发布,唯一实锤是蚂蚁 inclusionAI 放出的 LLaDA2.2-mini 扩散语言模型权重;真正热闹的是框架侧对 DeepSeek-V4、GLM-5.3-Flash、Kimi-K3、MiniMax-M3 等一批"听说过名字但官方还没发文"的模型做适配,以及媒体围绕 GPT-6 Astra 上线后遗症的持续报道。

正式发布

早期信号

媒体转述(二手)

判断

今天真正值得记一笔的只有 LLaDA2.2-mini 这个小众扩散语言模型,热度低,暂不必跟进。更值得盯的是早期信号里密集出现的 DeepSeek-V4、GLM-5.3、Qwen3.8-Flash-Next、Kimi-K3、MiniMax-M3 这五个"框架已在适配、官方未发文"的型号,说明下一波旗舰发布可能在近期集中到来,建议接下来几天重点盯这几家的官方博客。GPT-6 Astra 相关全是媒体转述且方向混乱(既报道故障又报道能力惊艳),噪音成分较高,等官方 release notes 更新后再评估。

原始条目

■ 权重 (1 条)

时间通道条目
09-05 13:16HF 新权重inclusionAI/LLaDA2.2-mini

■ 框架 (18 条)

时间通道条目
09-06 22:17框架 PRdeepseek4 —— 框架侧 3 个 PR(vllm 3)
09-06 21:57框架 PRllama.cpp #28493: CPU : add BF16 support for GET_ROWS_BACK
09-06 20:27框架 PRvllm #55570: Added validation in _get_runner_type() to check if the model archite…
09-06 20:14框架 PRvllm #55566: [Perf][Multimodal] Avoid sorting MiMo vision window indices
09-06 19:42框架 PRvllm #55565: [Perf][Tool Parser] Track DeepSeek streaming delimiters incrementally
09-06 19:31框架 PRvllm #55563: [Bugfix][GLM-5.3] Fit the kpool-widened sparse top-k buffer to the 2048-wide SM120 index without a config edit
09-06 19:29框架 PRvllm #55562: [Feature] Add reasoning_eos_policy to close think on mid-reasoning EOS
09-06 18:48框架 PRtransformers #48563: [VLM] Support shift_labels in Qwen3-VL, Qwen3-VL-MoE, and Gemma3 loss computation
09-06 16:25框架 PRvllm #55558: [Frontend] glm47 tool parser: render tool schema properties
09-06 16:10框架 PRvllm #55557: [Model] Qwen4Exp: fp8_e4m3 main KV cache on the QSA path
09-06 12:36框架 PRllama.cpp #28468: ggml : add BPOSIT8 tensor type (b-posit8 W8A8 with exact 256-bit quire accumulation)
09-06 11:49框架 PRvllm #55531: [KV Connector] Support symmetric DCP disagg for hybrid mamba models
09-06 11:00框架 PRllama.cpp #28466: model : support Kimi-K3 recurrent-state rollback
09-06 10:39框架 PRvllm #55527: [Bugfix][Model] Regression-test the Qwen3.5-MTP draft unquantized-build contract (#48816 follow-up)
09-06 10:08框架 PRvllm #55525: [Model] Mamba2: Add exact replay for bit-identical SSM paths
09-06 10:01框架 PRvllm #55523: [Bugfix][Mooncake] Fix mixed-TP GQA and indexer cache transfers for MiniMax-M3
09-06 06:36框架 PRtransformers #48551: [serge] Fix 2 integration tests for model `glm4_moe` failing with `OOM` (other (2))
09-06 05:17框架 PRllama.cpp #28457: vulkan: small M matrix optimizations for qwen

■ 媒体 (8 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。