AI 情报站

大模型发布监控65 条

2026-09-24

回看 2 天 · 新增 65 条(官方 23,框架 19,媒体 14,权重 9)

⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(366 天前)

一句话总览

本期最重要的是 OpenAI 正式推出 GPT-6 Sol 与 GPT-6 Luna,API 价格对 GPT-5.6 同档直接砍半;同一天 Claude Opus 5.5 上线微软 Foundry 与 AWS GovCloud,每 token 降价并大幅下调缓存读取价。中低价位档正式进入价格战,Gemini 4 则只有媒体放风、尚无官方发布。

正式发布

早期信号

媒体转述(二手)

判断

真正影响选型和成本的是 GPT-6 Luna 与 Sol:Luna 0.10/0.50 美元把分类、抽取、路由这类高吞吐任务的成本压到了此前 Haiku 4.5 的十分之一,值得马上拿现有批量任务做一轮 A/B;Sol 2/10 美元对标 Opus 5.5 的 4/20 美元,编程与 agent 场景的默认模型需要重新评估。Opus 5.5 的价值主要在长会话 agent 场景,缓存读取大幅降价加上更省 token,实际账单降幅可能高于名义 20%,但要看 Anthropic 官方基准补齐。Gemini 3.8 TTS 是垂类工具,DeepSeek-V4 与 Qwen4Exp 的框架 PR 值得持续盯,Gemini 4 目前全是媒体放风,不构成任何决策依据;Ling 系列的批量更新大概率是文档动作,无需跟进。

原始条目

■ 官方 (23 条)

时间通道条目
09-24 00:00Google DeepMind BlogAdvancing Private AI Compute with secure, server-side memory
09-24 00:00OpenAI NewsTwo years of OpenAI Academy
09-23 23:25Google DeepMind BlogGemini 3.8 text-to-speech says hello
09-23 21:00OpenAI NewsOpenAI extends cyber access to Ukraine for civilian defense
09-23 20:00OpenAI NewsHarvey turns legal context into stronger drafts with GPT-6 Astra
09-23 20:00OpenAI NewsSam Altman’s remarks at the United Nations Security Council
09-23 20:00OpenAI NewsHow invideo improves color grading 3x with GPT‑6 Astra
09-23 20:00OpenAI NewsRingg’s AI agents resolve up to 65% of customer calls with OpenAI
09-23 18:00OpenAI NewsIntroducing MentalHealthBench
09-23 10:00OpenAI NewsChatGPT Ads expands to Southeast Asia and Taiwan
09-23 09:00OpenAI NewsAirbnb widens access to GPT-6 Astra and OpenAI frontier models
09-23 08:00OpenAI NewsGrab and OpenAI bring practical AI skills to Southeast Asia
09-23 05:00OpenAI NewsBetter prompt caching for GPT-6
09-23 02:30Azure BlogGPT-6 Astra, Sol, and Luna: For production agents in Microsoft Foundry
09-23 02:09AWS What's NewOpenAI GPT-6 Sol and GPT-6 Luna are now generally available on Amazon Bedrock
09-23 02:00OpenAI NewsIntroducing GPT-6 Sol and Luna
09-23 01:00Azure BlogClaude Opus 5.5 comes to Microsoft Foundry for long-running coding and knowledge work
09-22 23:00AWS What's NewClaude Opus 5.5 is now available on AWS GovCloud (US)
09-22 23:00AWS What's NewClaude Opus 5.5 is now available on AWS
—Claude 文档索引Prompting Claude Opus 5.5
—Claude 文档索引Claude Opus 5.5
—Claude 文档索引Claude Opus 5.5
—Google Developers BlogIntroducing Support for Local AI Models in the Antigravity SDK

■ 权重 (9 条)

■ 框架 (19 条)

时间通道条目
09-24 20:48框架 PRtransformers #49084: Remap the legacy Gemma 1 hidden_act in the config post-init
09-24 19:11框架 PRvllm #58547: [ROCm][Perf] Fix Gemma AR+RMS prefill fallback
09-24 18:26框架 PRtransformers #49081: Fix Gemma 1.0 legacy GELU activation mapping in config
09-24 18:23框架 PRdeepseek4 —— 框架侧 2 个 PR(vllm 2)
09-24 18:08框架 PRvllm #58538: [Security] Reject unresolved paths in Kimi vision loading
09-24 17:51框架 PRvllm #58534: [Feature][Multimodal] Add opt-in CPU preprocessing process workers
09-24 17:40框架 PRvllm #58531: [Feature][Model] Add native DistilBERT sequence classification support
09-24 17:23框架 PRvllm #58527: [Kimi-K3][Perf] Dispatch GEMM for vision patch embedder
09-24 17:14框架 PRllama.cpp #29363: laya: Add support for the laya multilingual decision model.
09-24 16:58框架 PRvllm #58526: [Minimax-M3][Perf] Use triton_mrope for vision tower + int64 offset fix for triton_mrope
09-24 16:44框架 PRtransformers #49077: Fix Qwen2Tokenizer ignoring pretokenize_regex (Qwen3.6 / Qwen3.8 wrong token IDs)
09-24 16:19框架 PRvllm #58521: [Bugfix] Keep Hunyuan A13B streaming envelope open until </answer> closes
09-24 15:37框架 PRllama.cpp #29358: webgpu: add bfloat16 support for MUL_MAT/MUL_MAT_ID/GET_ROWS
09-24 11:24框架 PRvllm #58505: [Bugfix] Keep closing </think> delimiter in MiniMax M2 append-think mode
09-24 09:47框架 PRvllm #58489: [Bugfix][Qwen4Exp] Keep pinned PLE prefetch ids out of the CUDA graph pool
09-24 07:52框架 PRvllm #58476: [Docs] Add ERNIE 4.5 to batch invariance tested models
09-24 06:53框架 PRvllm #58468: [Model] Update RADIO vision encoder to match the current Transformers version
09-24 06:42框架 PRvllm #58466: [WIP][Sampling] Add adaptive verification support to batch-sharded sampling
09-24 05:14框架 PRvllm #58454: [Bugfix][GLM-5.3-Flash] kpool corruption with speculative decoding

■ 媒体 (14 条)

摘要引擎:claude。
证据分级:官方 = 厂商博客/文档 release notes(官方口径);权重 = Hugging Face 新 repo(最硬的一手,常领先博文);框架 = transformers/vllm/llama.cpp 的加架构 PR(未发布的早期信号,领先数天到数周);媒体 = 二手转述,措辞可能失真。
已知覆盖缺口:x.ai 整站 Cloudflare 403(Grok 只能靠媒体转述);anthropic.com 无 RSS,改用 docs.claude.com release notes;Grok 靠 docs.x.ai/llms.txt 覆盖(Cloudflare 只拦 x.ai 网页、不拦文档站);Qwen 官网是 catch-all SPA,只能取到首页 banner 的文章 slug、抓不到正文;seed.bytedance.com 无可用 feed,靠 HF 权重通道兜。
本页内容由 modelwatch/modelwatch.py 自动生成。
AI News 与模型发布两个栏目由本机 cron 每晚自动抓取、LLM 摘要并发布;HBR 精读与股票分析为手工撰写、不定期更新,股票分析不构成投资建议。页面构建于 2026-10-03 23:55 CST。
源脚本:ainews-digest/ainews_digest.py、modelwatch/modelwatch.py;发布器:digest-site/publish.py。