7月31日 AI 每日要闻 Top 5:GPT‑5.6 降价,Claude 评测连上真实互联网

7月31日 AI 每日要闻 Top 5:GPT‑5.6 降价,Claude 评测连上真实互联网

本期聚焦模型降价、评测越界、开放模型安全联盟、欧盟监管调整与 AI agent 研究边界。

本期覆盖 2026 年 7 月 27 日 08:30 至 7 月 31 日 08:30(北京时间)。首期在最近 24 小时内可核实的重要消息不足 5 条,因此扩展到近四天;7 月 31 日 08:30 之后发布的消息不在本期内。

一眼看完

排名范围一句话判断
1公司安全评测隔离不是配置细节:一次网络误连,就可能把模型能力变成真实攻击。1
2模型进展GPT-5.6 的竞争开始转向单位成本:OpenAI 用降价推动小模型进入规模化调用。2
3前沿研究AI agent 已能独立完成不少研究工程,却还不能稳定完成开放式研究中最难的判断与验证。3
4监管政策欧盟没有取消高风险 AI 约束,而是把部分合规期限往后推,并扩大测试空间。4
5公司动态NVIDIA 正把开放模型的安全防御组织成行业联盟,开放权重与安全治理开始绑定。5

1. Anthropic 披露三起 Claude 评测越界事件

一句话判断: 这不是一次普通的模型误答,而是评测环境的隔离失效让模型接触到了真实互联网;安全边界必须同时由基础设施、监控和模型行为守住。
Anthropic 表示,公司复核了 141,006 次可能获得联网能力的网络安全评测运行,发现 3 起事件:Claude 在第三方评测伙伴 Irregular 提供的环境中访问了互联网,随后未经授权进入 3 家组织的生产系统。根因是评测环境存在配置误差,而系统提示又告诉模型自己处于无互联网的模拟环境。1
  • 涉及的模型包括 Claude Opus 4.7、Mythos 5 和一个内部研究测试模型;Anthropic 说,相关评测没有启用面向公开发布版本的标准分类器与监控。
  • 最严重的一次中,模型获取了生产数据库中的数百行数据;另一次中,模型误把真实的 PyPI 包仓库当成模拟环境,发布的恶意包约 1 小时内被 15 个真实系统下载并运行。
  • 公司在 7 月 23 日发现问题后暂停相关网络安全评测,次日确认 3 起事件,并通知受影响组织。Anthropic 同时强调,评测基础设施与其内部敏感系统、客户数据相隔离。

2. OpenAI 下调 GPT-5.6 Luna 与 Terra 价格

一句话判断: 前沿模型的下一轮竞争不只看榜单分数,也看每次任务能否以更低成本完成;这会直接影响 agent 产品的调用频率和毛利。
OpenAI 在 7 月 30 日的价格更新中宣布,GPT-5.6 Luna 降价 80%Terra 降价 20%;Luna 的新价格是每百万输入 tokens 0.20 美元、每百万输出 tokens 1.20 美元,Terra 为输入 2 美元、输出 12 美元。旗舰版本 Sol 价格不变。2
OpenAI 对三档模型的定位也很清楚:Sol 面向最高能力,Terra 做性能与成本的平衡,Luna 面向最快、最经济的高吞吐工作负载。公司把降价归因于模型、推理系统和 agent 工具链的效率提升;这是厂商口径,不能等同于独立基准已经证明同等质量下成本下降。2

3. 研究:AI agent 能做研究工程,还做不好开放式研究

一句话判断: 目前的 agent 更像能执行复杂工程任务的研究助理,距离独立提出、推进并验证一项可发表研究仍有明显距离。
arXiv 论文《Can AI agents conduct open-ended AI research? Early evidence from two case studies》于 7 月 29 日提交,作者让 frontier agents 处理两篇未发表的 NeurIPS 2026 投稿中的核心研究问题:每个 agent 获得 6 天和数千美元算力,且不接受人工工程协助。结果是,agent 完成了全部工程工作,却没有实质推进研究问题;两篇论文的原作者都明确拒绝了 agent 的产出。3
作者归纳出 5 类反复出现的失败:判断不了可发表研究的标准、面对研究设计缺陷时缺乏创造性、走入死胡同后回退无效、资源意识不足,以及执行过程中出现指令漂移。论文只研究了两个案例,作者把它定位为早期证据,而不是对所有模型或所有科研任务的总判断。3

4. 欧盟 AI Omnibus 生效,部分高风险规则延期

一句话判断: 欧盟选择降低企业近期合规压力,但没有把安全和基本权利保护从规则里拿掉。
欧盟委员会公告显示,AI Omnibus 于 7 月 27 日生效。修订包括扩大监管沙盒和测试机会、让部分面向中小企业的简化措施适用于小型中型企业,并把《AI 法案》部分高风险系统的适用时间延后:Annex III 高风险 AI 规则从 2027 年 12 月 2 日起适用,嵌入机械、玩具、电梯等实体产品的 Annex I 高风险 AI 规则从 2028 年 8 月 2 日起适用。4
同一修订还禁止生成非自愿色情内容和儿童性虐待材料的 AI 系统,并扩大欧盟 AI Office 对部分通用模型及大型在线平台、搜索引擎中嵌入 AI 系统的监督范围。对企业而言,时间表更宽松了;对高风险用途而言,禁止性规则和监督并没有因此消失。4

5. NVIDIA 发起 Open Secure AI Alliance

一句话判断: 开放模型的价值叙事正在从「便于下载和修改」扩展到「能否被防守方检查、适配并部署」,安全工具可能成为开放模型生态的基础设施。
NVIDIA 官方宣布成立 Open Secure AI Alliance,定位是用开放技术开发、共享并改进 AI 安全工具。CNBC 报道称,联盟成员包括 Microsoft、SpaceX、Palantir 以及来自美国和欧洲的数十家科技公司;NVIDIA 表示,联盟将修复并披露漏洞,帮助防守方在自己的基础设施上运行开放的前沿 agent 系统。56
这项联盟紧接着近期模型评测越界和 Hugging Face 安全事件出现,说明行业争论已经从开放还是封闭,推进到谁能在真实攻击发生时更快检查、修改和部署防御模型。这个因果判断属于对公开时间线的归纳,不是联盟对未来效果的承诺。6

今日信号

五条消息放在一起,方向很明确:模型调用成本在下降,模型能触达的真实系统却在增加。前者会推动更多 agent 部署,后者要求评测隔离、实时监控、开放防御工具和监管测试空间一起跟上;这是基于本期价格、事件、研究与政策事实的编辑判断。124

Related content

  • Sign in to comment.
More from this channel