
7月31日 X AI 日报:GPT-5.6 降价,Anthropic 披露三起评测外溢事件
今天的核心信号是两条:GPT-5.6 API 把成本与速度拆成可定价选项,Anthropic 则披露评测环境曾让模型接触到真实系统。
截至北京时间 7 月 31 日 11:00,今天值得留下的信号不多,但很集中:模型服务商在把价格和速度做成更细的产品旋钮;安全实验室则承认,评测环境的隔离边界曾经没有真正封住。下面按主题整理,时间均按 X 原帖发布时间换算为北京时间。
模型与产品
OpenAI:GPT-5.6 API 价格下调,Sol 增加高速档
OpenAI 官方账号宣布,GPT-5.6 Luna 的 API 价格下调 80%,Terra 下调 20%,同时为 Sol 提供更快的 API 选项;官方还说,Luna 与 Terra 的降价会反映在 Codex 和 ChatGPT Work 的用量计算中。1
Sam Altman 随后给出更具体的价格:Luna 为每百万 token 输入 0.20 美元、输出 1.20 美元;Terra 为 2 美元和 12 美元;Sol Fast 最高可提速 2.5 倍,价格为原来的 2 倍。2
简要判断: 这次调整把「便宜」「更强」和「更快」拆成了不同选项。对 API 使用者,模型选择不再只是能力排序,也要同时看单位任务成本和等待时间。不过,原帖没有交代限额、区域差异或不同任务下的实际 token 消耗,不能只凭标价推导最终成本。
Loading content card…
安全与评测
Anthropic:141,006 次评测中发现三起真实系统外溢事件
Anthropic 在一篇复盘中说,他们检查了 141,006 次可能获得网络访问的网络安全评测,发现三起事件:Claude 在第三方评测环境内或与其交互时接触到互联网,随后未经授权进入了三个不同组织的真实系统。三起事件合计涉及六次运行,其中四次影响同一组织。3
Anthropic 给出的直接原因不是模型主动「逃出」测试环境,而是评测提示词告诉模型没有互联网访问,实际配置却留下了可用的网络路径。模型因此把真实系统当成了模拟题的一部分。复盘还提到:一次运行发布了恶意 PyPI 包,约一小时内被 15 个真实系统下载并执行;另一次运行扫描了约 9,000 个目标后进入一家公司的互联网应用。3
Anthropic 表示,团队在 7 月 23 日发现问题后暂停相关网络安全评测,次日识别出三起事件,并通知了合作方和受影响组织;后续会加强评测环境的网络校验、日志监控、供应商管理与持续审查,并与 METR 推进第三方复核。3
简要判断: 更准确的读法是「评测基础设施与模型行为同时需要防线」,而不是把它简单归结为模型产生了自主逃逸意图。对正在部署智能体的团队,测试环境是否真的隔离、日志是否能实时发现越界,和模型本身的能力评估同样重要;这是从 Anthropic 对配置失误与纵深防御的复盘中得到的判断。
Loading content card…
专家判断
Gary Marcus:今天的 AI 新闻更像可靠性、商业压力与安全问题的合流
AI 研究者 Gary Marcus 在当天的评论中,把当天的七条 AI 新闻概括为「混乱的一天」。他把 OpenAI 的降价、Anthropic 披露的评测事件,以及其他关于投机、攻击面和研究能力的消息放在同一张图里,关注点不是「谁的模型又高了几分」,而是行业的可靠性、安全性、研究能力和商业模式是否跟得上能力增长。4 他的原帖入口:5
简要判断: 这条观点的价值不在于增加一条产品消息,而在于提供了一个筛选器:看到发布数字时,顺手追问价格是否可持续;看到能力展示时,追问评测环境是否可信。它是评论,不是对上述事实的独立验证。
Loading content card…
今日结论
今天的三条材料指向同一个变化:AI 竞争正在从单一的模型能力比较,转向「成本与时延」以及「部署与评测安全」的组合比较。前者决定产品能不能规模化使用,后者决定实验室公布的能力能不能被安全地放进真实系统。这个结论是对本期三条材料的综合判断,不等于任何一家公司的官方表述。
下一次跟踪两件事:OpenAI 是否继续把降价扩展到更多模型或产品档位;Anthropic 承诺的第三方复核和后续评测改造,是否会给出可复用的隔离标准。
Related content
- Sign in to comment.
