大模型发布监控36 条
2026-09-09回看 2 天 · 新增 36 条(框架 18,媒体 12,官方 6)
⚠️ 以下源疑似停更/换阵地(能正常抓取但最新条目很旧,属于不可见的覆盖缺口,需人工换源):Qwen Blog(351 天前)
一句话总览
今天最硬的一手消息是 AWS 官宣 OpenAI 的 GPT-6 Astra 在 Amazon Bedrock 正式 GA,加上 OpenAI 自家发布图像模型 ChatGPT Images 2.5(含两款 API 新模型)。其余多为框架侧适配与媒体转述,其中 vLLM 里的 MiniMax M3 / Kimi-K3 / DeepSeek-V4 痕迹值得留意。
正式发布
- OpenAI × AWS · GPT-6 Astra(Bedrock GA)· 2026-09-09 —— AWS What's New 官方发文,OpenAI 的 GPT-6 Astra 现已在 Amazon Bedrock 正式可用,这意味着 OpenAI 当前旗舰不再只能走 OpenAI 自家 API,Bedrock 用户可以在 AWS 合规/计费体系内直接调用。条目里没有给出参数、上下文、定价等规格,细节待官方补充。这是 OpenAI 旗舰首次以 GA 形态进入 Bedrock 目录,对选型的影响大于模型本身的增量。来源
- OpenAI · ChatGPT Images 2.5 / GPT-Image-2.5 Flare & Sunburst · 2026-09-08 —— OpenAI 官方博客发布新一代图像模型 Images 2.5,主打更锐利的细节、更精确的多轮编辑、对参考照片主体保真度更高,生成延迟相比 Images 2.0 最多降低 50%。API 侧同时上线两款模型:GPT-Image-2.5 Flare(同等质量提升、速度优先)和 GPT-Image-2.5 Sunburst(更高精度、生成时间更长)。ChatGPT 端新增 Sketch 手绘参考、模板、图上评论与提示词分享;面向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放。定价条目正文未抓到,待官方页面补充。来源
早期信号
- OpenAI 更强内部模型 —— OpenAI 官方在 Navier–Stokes 千禧年难题的研究博文中明确写道,解题所用的是"比 GPT-6 Astra 显著更强的内部模型",并称要让外界了解"即将到来的模型"的节奏,疑似在为 GPT-6 之后的下一代旗舰预热。来源
- MiniMax M3(含 VL 与 MXFP8 变体) —— vLLM 两个 PR 分别处理 MiniMax M3 VL 的像素预算边界和 MiniMax-M3-MXFP8 的 ROCm 解码 CUDA graph;HF 上尚无官方同版本权重,疑似 MiniMax 下一代多模态基座在做上线前适配,或将以闭源 API 形态推出。来源
- Kimi-K3 —— vLLM 出现"[Kimi-K3] Reduce RecoverSSM state commit overhead"和"AITER KDA prefill for Kimi-K3"两个 PR,透露 K3 疑似采用 SSM/KDA 线性注意力混合架构;HF 无官方权重,仍处于适配阶段。来源
- DeepSeek-V4 —— vLLM 修复 DeepSeek-V3.2 工具消息编码复杂度的 PR 中顺带提到"DeepSeek-V4 already merges tool messages in a linear pass",说明 V4 的聊天模板编码器已经进入 vLLM 代码库,疑似 V4 已在框架侧完成适配但条目里无权重证据。来源
- Nanbeige4.2-3B —— vLLM 新增 Nanbeige4.2 的 transformers 后端支持,测试命令直接指向 Nanbeige/Nanbeige4.2-3B 仓库并复用 qwen3 推理解析器,疑似一款 3B 级小模型已上线或即将上线,PR 未附测试结果。来源
- "Qwen4 next flash"(存疑) —— llama.cpp 有一个标题写着 Qwen4 Next Flash 的多卡修复 PR,但作者贴出的实际运行文件是 Qwen3.8-Flash-Next 的 GGUF,且 PR 自述"未完成、随时可关",HF 无 Qwen4 官方权重,大概率只是标题命名混乱,不宜当 Qwen4 信号。来源
媒体转述(二手)
- 据 Geeky Gadgets 报道,Google 将 Gemini 4 Pro 的发布时间推迟到 2026 年 10 月。
- 据 IndexBox 报道,GPT-6 Astra 发布后 Nvidia CEO 称其"开启 AGI 时代",属评论性转述。
- Mistral 官网发文《Making sovereign, open-weight AI the technology frontier》,经 Google News 转述,正文未抓到,看标题是开放权重与主权 AI 的立场文而非新模型。
- 据 Devdiscourse 报道,DeepSeek 在 AI 市场竞争加剧背景下启动 IPO。
判断
真正影响选型的是 GPT-6 Astra 进 Bedrock:已经在 AWS 上跑业务、又受合规约束不能直连 OpenAI 的团队,现在多了一条正规通道,值得马上核对 Bedrock 侧的定价与区域可用性。Images 2.5 属于图像赛道的实质升级,两款 API 变体按速度/精度分档,有图像生成或编辑管线的团队可以直接做 A/B。
框架侧的 MiniMax M3、Kimi-K3、DeepSeek-V4 三条线都是"权重未到、代码先到"的典型前奏,其中 Kimi-K3 的 SSM/KDA 混合架构线索最具体,建议持续盯 HF 组织页。OpenAI 借千禧年难题放话"内部模型远强于 GPT-6 Astra",是明确的下一代预热,但今天没有可用的产品。其余 Whisper/reranker/OCR/granite 的 PR 与 Accenture 商业合作、ETF 软文都是常规迭代或噪音。
原始条目
■ 官方 (6 条)
■ 框架 (18 条)
■ 媒体 (12 条)