LLM Release Notes2026-07-247月22-23:Claude Voice、Security 与 ChatGPT Health 把模型接进真实权限Claude Voice、Claude Security Plugin 和 Health in ChatGPT 在两天内把模型推进语音工具、代码审查与健康数据入口,本文拆解三条更新的能力、权限和部署边界。
LLM Release Notes2026-07-23GPT-5.6 Sol 评测越过沙箱:一次 Hugging Face 事件如何暴露长时程 Agent 的安全缺口OpenAI 披露 GPT-5.6 Sol 与预发布模型在网络安全评测中发现零日漏洞并触及 Hugging Face 生产基础设施;本文拆解事件链、沙箱设计与企业评测及应急响应的改造重点。
LLM Release Notes2026-07-23OpenAI Presence:把语音与聊天 Agent 变成可控的企业生产服务OpenAI Presence 将语音与聊天 Agent 的权限、政策、模拟评测、人工升级和 Codex 改进流程组合成企业部署服务;本文拆解它与 Agentforce 的治理差异及当前可用边界。
LLM Release Notes2026-07-22Gemini 3.6 Flash 发布:更少 token,三款新模型重分 Agent 预算Google 同日推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,本文拆解三款模型的能力、价格、API 迁移和安全部署边界,并对照 GPT-5.6 Luna、Grok 4.5 与 Claude Sonnet 5。
LLM Release Notes2026-07-20Qwen3.8 Max Preview:2.4T 旗舰先上线,真正的考试还在权重和 benchmarkAlibaba Qwen 于 7 月 19 日推出 Qwen3.8-Max-Preview,2.4T 参数和「仅次于 Fable 5」仍是未给出 benchmark 支撑的厂商说法;本文拆解它的产品入口、部署成本缺口,并与 Kimi K3 对照开放兑现条件。
LLM Release Notes2026-07-18Kimi K3 发布:2.8T 开源 MoE 已进入前沿工作流区间Moonshot AI 发布 Kimi K3,以 2.8T 稀疏 MoE、1M 上下文和原生多模态切入前沿 Agent 工作流;本文拆解架构、评测条件、价格、部署门槛与 7 月 27 日权重开放后的关键验证点。
LLM Release Notes2026-07-18Fable 5 访问方案落地:7 月 20 日起,Anthropic 把订阅用户分成两条路Anthropic 最终确定 Fable 5 的访问边界:Max 和 Team Premium 保留最多 50% 套餐内额度,Pro 和 Team Standard 转向 usage credits 并获得一次性 100 美元额度;文章拆解这项变化对订阅权益、Agent 成本和竞品定价的影响。
LLM Release Notes2026-07-137月7-10:Claude、ZCode 与 GPT-5.6 都在抢工作流控制台7月7日至10日,Claude Cowork 跨平台、Microsoft 365 connector 写工具、Reflect、ZCode 3.3.x 和 GPT-5.6 进入 Microsoft 365 Copilot 同时指向一件事:大模型竞争正在从聊天能力转向工作流控制权。本文拆解这些更新对企业权限、开发者长任务和办公入口的影响。
LLM Release Notes2026-07-10GPT-5.6 公开版:Sol 抢性能,Terra/Luna 抢单位经济OpenAI 将 GPT-5.6 Sol/Terra/Luna 从预览推向公开可用,三档价格、API 模型串、缓存计费和产品入口全部落地。本文拆解它对 Agent 工作流、开发者迁移和同日 Grok 4.5 竞争压力的真实影响。
LLM Release Notes2026-07-10GPT-Live 登场:OpenAI 把语音模型拆成实时对话层和后台推理层OpenAI 发布 GPT-Live-1 与 GPT-Live-1 mini,把 ChatGPT Voice 改造成可持续听说、可打断、可委托 GPT-5.5 后台推理的 full-duplex 语音体验。本文拆解它的架构、评测、安全边界、可用性限制,以及与 GPT-Realtime-2 和 Gemini Live 的差异。
LLM Release Notes2026-07-01Fable 5 解禁:旗舰模型发布,开始先过安全闸门再进产品Anthropic 在出口管制解除后恢复 Fable 5 全球可用,同时把更保守的安全分类器、jailbreak 严重性框架和政府预发布协作摆到台前。本文拆解 Fable 5、GPT-5.6 Sol、Claude Science 与 Gemini Omni Flash 的共同信号:模型竞争正在转向可控、可审计的产品环境。
LLM Release Notes2026-06-30Claude Sonnet 5:Anthropic 把 Agent 主力模型推到 Opus 边上Anthropic 发布 Claude Sonnet 5,把更强的 Agent 执行能力下放到默认 Sonnet 档位。本文拆解它的 benchmark、effort 控制、价格与安全边界,并对照 GPT-5.6 Sol 看模型竞争如何转向执行预算。