AI 情报站

大模型发布监控42 条

2026-10-03

回看 2 天 · 新增 42 条(框架 16,媒体 12,官方 11,权重 3)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(375 天前)

一句话总览

今天最值得知道的是 OpenAI GPT-6 系列的落地:GPT-6 Astra Ultrafast 已经在 API 上线,官方也发布了 GPT-6 选型与使用指南。Anthropic 文档站同时确认 Claude Sonnet 5.5 已于 9 月 28 日发布,规格为 1M 上下文、每百万 token 输入 $2、输出 $10。Gemini 4 Argon 的讨论很多,但本次只抓到媒体转述,没有抓到 Google 官方渠道的条目。

正式发布

早期信号

媒体转述(二手)

判断

真正值得动手试的有两个。一是 GPT-6 Astra Ultrafast:标称最高 8 倍速,对编码 agent 这类多轮工具调用的场景,能直接缩短端到端时间,值得拿自己的 agent 流程实测一下延迟和价格。二是 Claude Sonnet 5.5:1M 上下文、$2/$10 的价格会影响选型和成本测算,但 5 处破坏性变更和重新校准的 effort 档位意味着不能直接替换旧模型 ID,要先回归测试。Gemini 4 Argon 目前只有媒体二手信息,而且看起来不对普通用户开放,等 Google 官方文档出来再评估。DeepSeek-V4.1 一天内冒出 3 个适配 PR,是最强的“快要发布”信号,值得盯住。其余条目,包括 AstaBrief、NVIDIA 像素生成模型、ETET 和 Granite 时序模型,都是小众或垂直方向,可以略过。

原始条目

■ 官方 (11 条)

■ 权重 (3 条)

时间通道条目
10-02 05:40HF 新权重nvidia/PixelUMM
10-02 05:26HF 新权重nvidia/PixelDiT2-ImageNet
10-02 00:28HF 新权重ibm-granite/ensemble-forecasting-with-ibm-granite-time-series

■ 框架 (16 条)

时间通道条目
10-03 21:14框架 PRvllm #59879: [Bugfix][Frontend] Fall back to free text in the GLM-4.7 structural tag without function tools
10-03 20:23框架 PRqwen4 —— 框架侧 2 个 PR(vllm 2)
10-03 17:50框架 PRvllm #59863: [DeepSeek-V4-P1] Add standalone batch-invariant SiLU FP8 quantization
10-03 17:48框架 PRllama.cpp #29900: Improve qwen3.8 27b performance on a 3090
10-03 16:39框架 PRllama.cpp #29896: ggml: add GGML_TYPE_BF16X - near-lossless bfloat16 recompression (11.5 bpw)
10-03 16:38框架 PRdeepseek4.1 —— 框架侧 3 个 PR(vllm 3)
10-03 13:32框架 PRvllm #59853: [Model] Drop the 4x M-RoPE cache headroom for Qwen3.5
10-03 09:47框架 PRqwen3 —— 框架侧 2 个 PR(vllm 2)
10-03 08:28框架 PRvllm #59833: [Bugfix][Model] GLM-5.x: load ModelOpt NVFP4 MLA projections into BF16 fused_qkv_a_proj
10-03 07:30框架 PRtransformers #49277: [serge] Fix 3 integration tests for model `deepseek_vl_hybrid` failing with `other` (other (3))
10-03 07:10框架 PRvllm #59827: [Model] Add Nemotron 3.5 ASR transcription support
10-03 05:08框架 PRvllm #59824: [ROCm][Kimi-K3] Support DSpark adaptive verification on MI355X
10-03 04:06框架 PRvllm #59822: perf: route GLM-5.2 fused-QKV-A GEMM through dsv3_fused_a_gemm on SM10x
10-03 02:36框架 PRllama.cpp #29873: llama: Add etetmoe-llama architecture and ETET1.0 support
10-03 00:02框架 PRvllm #59797: [Metrics] Add delivery counters for the KV event publisher
10-02 19:04框架 PRvllm #59767: [Model] Migrate Aria to the Transformers modeling backend

■ 媒体 (12 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。