AI 情报站

大模型发布监控26 条

2026-09-12

回看 2 天 · 新增 26 条(框架 12,媒体 9,官方 4,权重 1)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(354 天前)

一句话总览

过去两天无新模型正式发布。最有分量的一手信息是 OpenAI 连发两篇 GPT‑6 Astra 客户案例(Cognition、Perplexity),确认该模型已在 API 侧承担端到端的自动测试与生产监控类任务;框架侧则密集出现 DeepSeek‑V4.1、GLM‑5.3‑Flash、Qwen4、MiniMax‑M3 的适配 PR,下一波国产开源旗舰已在路上。

正式发布

早期信号

媒体转述(二手)

判断

真正值得跟进的是两条线:一是 GPT‑6 Astra 已被 Cognition、Perplexity 用于"自测并出证据"和"少盯管的端到端自动化",这直接关系到代理型编码工具的选型,值得拿自家 CI 场景实测;二是 DeepSeek‑V4.1 已合入 vllm 主线、transformers 也在加模型类,通常意味着开源权重只差一个博客,自建推理的团队可以提前评估 Engram 层对显存与部署拓扑的要求。GLM‑5.3‑Flash、Qwen4、MiniMax‑M3 的 PR 密度说明国产厂商正扎堆在 Q3 末冲发布,但眼下只是信号,不必动手。NVIDIA 语音模型、Bedrock 多模态 embedding 属常规迭代;Gemini Windows 客户端和"Gemini 4 大升级"报道是噪音,等官方发文再看。

原始条目

■ 官方 (4 条)

■ 权重 (1 条)

■ 框架 (12 条)

■ 媒体 (9 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。