AI 情报站

大模型发布监控37 条

2026-08-04

回看 2 天 · 新增 37 条(官方 26,框架 6,媒体 3,权重 2)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(315 天前)

一句话总览

今天的硬料主要来自各厂文档站与 Hugging Face:Moonshot 官方定价页已明确写出「Kimi K3 旗舰模型已正式发布」(1M 上下文、始终推理),Anthropic 文档索引新增 Claude Fable 5 / Mythos 5 模型页,xAI 的 grok-4.20 系列与智谱 GLM-5 系列也已在文档中可调用;HF 侧 MiniMax-H3 视频/音视频生成权重刚刚公开。唯一的官方博客发文是 Mistral 的 3B 安全分类器 Shieldstral。

正式发布

早期信号

媒体转述(二手)

判断

真正值得动手的有三件。Kimi K3 是今天影响选型最直接的一条:1M 上下文加上可分档的 reasoning_effort(默认就是 max,不显式调就是最贵的档),再加 tool_choice 约束和动态加载工具,意味着长上下文 Agent 的成本曲线和可控性都要重新测一遍,别按 K2 系列的经验估预算。MiniMax-H3 的 image/text-to-audio-video 是能力面上的跨越而不是刷分,下载量还是 0,现在试就是第一批。Shieldstral 3B 的价值在于把审核这类高频低价值调用从旗舰模型上卸下来,是笔省钱账。

其余多是噪音或工程性维护:vLLM 的 SSE keep-alive、KV offload 的 out-of-tree 加载、CI 显存调参都属日常,不影响选型;xAI 文档里的 grok-4 / grok-4-0709 是存量型号而非新发;gpt-4o-realtime-preview 出现在 xAI 通道八成是抓取串台,别当情报。另外提醒两处口径差:媒体说 Qwen3.8-Max 已发,一手渠道今天只有 Qwen3.5 的框架适配,两者对不上,采信前等官方发文;Gemini 3.5 Pro 的 8/12 日期是单一小站传闻,不要写进任何计划表。

原始条目

■ 官方 (26 条)

■ 权重 (2 条)

■ 框架 (6 条)

■ 媒体 (3 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
由本机 cron 每晚自动抓取、LLM 摘要并发布。页面构建于 2026-08-06 18:46 CST。
源脚本:ainews-digest/ainews_digest.pymodelwatch/modelwatch.py;发布器:digest-site/publish.py