今天没有旗舰级正式发布。一手证据里只有两件实事:Qwen 悄悄上传了 Qwen-Image-2.1 的两个提示词增强(PE)权重,以及蚂蚁 Ling-3.0-flash-VL 多模态 MoE 的 llama.cpp 适配落地。更值得留意的是 vLLM 侧一天之内集中出现 8 个 DeepSeek V4 / V4.1 相关 PR,架构细节正在被框架侧"剧透"。
真正值得跟的是 DeepSeek V4/V4.1 那一簇 PR:ROCm 都在做 FP8 布局和 decode 融合,说明适配已进入性能阶段而不是能跑就行,V4.1 换 tokenizer 模式也意味着接入要重新验证分词,做推理部署选型的人可以提前读这些 PR 了解架构。Ling-3.0-flash-VL 是今天唯一能立刻上手的新东西,5.1B 激活的多模态 MoE 对本地 VL 部署有吸引力,但 248 GB 的 BF16 GGUF 说明总参数摆在那,显存门槛不低。Qwen-Image PE、Gemma 4 调优、Whisper/Qwen2.5-VL 之类修复都是常规迭代;Kimi K3 上 Bedrock 若属实会改变多云可用性,等官方口径再算成本。
| 时间 | 通道 | 条目 |
|---|---|---|
| 09-20 16:46 | HF 新权重 | Qwen/Qwen-Image-2.1-PE-I2I |
| 09-20 16:45 | HF 新权重 | Qwen/Qwen-Image-2.1-PE-T2I |
| 时间 | 通道 | 条目 |
|---|---|---|
| 09-20 20:04 | 媒体转述 | Google Preps Gemini 4 Pro Content Creation for October 2026 - Geeky Gadgets |
| 09-20 14:19 | 媒体转述 | B 站上线“AI 无限竞技场”:百大模型同台 PK,GPT-6 Astra 暂居榜首 - AIBase |
| 09-20 09:51 | 媒体转述 | 千问发布 Qwen3.8-LiveTranslate 同声传译大模型:原文译文同屏出,字均延迟压到 2.3 秒 - AIBase |
| 09-20 08:43 | 媒体转述 | 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出 - Donews |
| 09-20 01:00 | 媒体转述 | 大模型,开始集体变小 - 36Kr |
| 09-19 00:52 | 媒体转述 | Introducing Kimi K3 on Amazon Bedrock | Artificial Intelligence - Amazon Web Services (AWS) |
modelwatch/modelwatch.py 自动生成。ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。