AI 情报站

大模型发布监控39 条

2026-08-20

回看 2 天 · 新增 39 条(框架 15,官方 13,媒体 6,权重 5)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(331 天前)

一句话总览

今天最硬的一手是智谱 GLM-5.3 上线(文档站已有独立模型页与迁移指南,1M 上下文、纯文本、强制推理,官方称 Z.ai Code Bench 编码能力比 GLM-5.2 提升 50%);同时 Kimi 开放平台确认 K3 已正式发布并给出 kimi-k2.5 / moonshot-v1 系列 8 月 31 日全平台下线 的硬时间点,Mistral 发布 Agentic Search 检索层,Grok 4.6 进入 Bedrock 跨区域推理。

正式发布

早期信号

媒体转述(二手)


判断

真正要动手的只有两件。一是 GLM-5.3:同基座纯 post-training 却把编码提了 50%,而且 1M 上下文 + 128K 输出 + Coding Plan 已覆盖,值得直接拿现有 GLM-5.2 的 prompt 跑对比;但要注意它不能关推理且默认 max effort,迁移时如果不显式降到 low,延迟和 token 成本会比 5.2 明显上去。二是 Kimi 的下线日历:8 月 31 日 kimi-k2.5 / moonshot-v1 全系停服,凡是还写死这些 model id 的调用方现在就该排期改,这是今天唯一带死线的信息。

成本侧值得顺手做的是 Grok 4.6 的 global.* profile 和 OpenAI 5.6 系列的降价——前者官方明写单 token 更便宜,后者已经便宜到能让 Replit 免费无限用,都会改变"贵模型只能省着用"的假设。ZDR + Private Safety Processing 对有数据合规约束的部门是解锁项,不是性能项。剩下的基本是噪音:Ling-3.0 只有权重没规格、VoiceChat 和 ArmorOCR 属小工具模型、几条框架 PR(ModernBERT FP8、Whisper normalizer、Qwen3-VL 在 Blackwell 上 FP8 静默挂起需升到 v0.25+ 或设 VLLM_USE_DEEP_GEMM=0)是运维层面的排障知识而非发布,媒体那几条"某行业大模型 2.0"更是与选型无关。

原始条目

■ 官方 (13 条)

■ 权重 (5 条)

■ 框架 (15 条)

■ 媒体 (6 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。