AI 情报站

大模型发布监控21 条

2026-09-27

回看 2 天 · 新增 21 条(框架 15,媒体 4,官方 2)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(369 天前)

一句话总览

过去两天无实质发布:一手渠道里没有任何厂商发布新模型或新 API,官方博客只有 OpenAI 一篇客户案例和 Google 一篇 OLMo 3 复现工程稿。真正值得看的都在框架 PR 里:Qwen4Exp、DeepSeek V4.1 VL、Kimi-K3、GLM-5.3 的适配工作在同步推进,说明下一波开源旗舰已在路上。

正式发布

无。今日抓到的官方渠道条目均非模型发布:OpenAI 的 Proaction 客户案例只是以已上线产品口吻提及 Codex、GPT-Live-1 与 GPT-6 Astra;Google Developers Blog 的 OLMo 3 7B 复现是 MaxText/TPU 训练工程文章,复现的是 AI2 已有模型,不是新权重。

早期信号

媒体转述(二手)

判断

今天没有可以直接拿来试的东西,但信号密度不低。最值得跟进的是 Qwen4Exp:三个框架同时在做同一套 GDN + PLE 结构的 kernel 融合与投机解码,这种深度适配通常领先正式发布几周,而 PLE 冷页 readahead 意味着 Qwen4 可能把逐层嵌入放到 checkpoint 里按需读取,对本地部署的显存占用是好消息。DeepSeek V4.1 VL 和 Kimi-K3 处于同一阶段,若你在等国产开源多模态或长文本旗舰,这两条线可以开始预留评测计划。GLM、MiniMax 的 PR 是 ROCm 路径和融合路由的修修补补,DeepSeek-OCR-2、Roberta reranker LoRA、Granite 文档更新都是常规生态噪音。V4.1-Flash"便宜 70%"的说法只有二手来源,先别据此调整选型,等官方定价页。Google 那篇 OLMo 3 复现对训练基础设施团队是一篇好的工程参考(MFU、mid-flight 换芯片、checkpoint 精确重放),和模型选型无关。

原始条目

■ 官方 (2 条)

■ 框架 (15 条)

■ 媒体 (4 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。