AI 情报站

大模型发布监控22 条

2026-09-20

回看 2 天 · 新增 22 条(框架 14,媒体 6,权重 2)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(362 天前)

一句话总览

今天没有旗舰级正式发布。一手证据里只有两件实事:Qwen 悄悄上传了 Qwen-Image-2.1 的两个提示词增强(PE)权重,以及蚂蚁 Ling-3.0-flash-VL 多模态 MoE 的 llama.cpp 适配落地。更值得留意的是 vLLM 侧一天之内集中出现 8 个 DeepSeek V4 / V4.1 相关 PR,架构细节正在被框架侧"剧透"。

正式发布

早期信号

媒体转述(二手)

判断

真正值得跟的是 DeepSeek V4/V4.1 那一簇 PR:ROCm 都在做 FP8 布局和 decode 融合,说明适配已进入性能阶段而不是能跑就行,V4.1 换 tokenizer 模式也意味着接入要重新验证分词,做推理部署选型的人可以提前读这些 PR 了解架构。Ling-3.0-flash-VL 是今天唯一能立刻上手的新东西,5.1B 激活的多模态 MoE 对本地 VL 部署有吸引力,但 248 GB 的 BF16 GGUF 说明总参数摆在那,显存门槛不低。Qwen-Image PE、Gemma 4 调优、Whisper/Qwen2.5-VL 之类修复都是常规迭代;Kimi K3 上 Bedrock 若属实会改变多云可用性,等官方口径再算成本。

原始条目

■ 权重 (2 条)

时间通道条目
09-20 16:46HF 新权重Qwen/Qwen-Image-2.1-PE-I2I
09-20 16:45HF 新权重Qwen/Qwen-Image-2.1-PE-T2I

■ 框架 (14 条)

■ 媒体 (6 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。