今天的行业,已经从「AI 要替人类工作」演到「AI 先替人类找漏洞」,连键盘都开始负责带兵。
1. GPT-Red:AI 开始给 AI 出阴招
OpenAI 在 7 月 15 日公布 GPT-Red:一个专门自动寻找模型漏洞的内部红队模型。OpenAI 称,它在一项间接提示注入测试中有 84% 的攻击成功率,人类红队员为 13%;它还能攻破包括 GPT-5.5 在内的多种模型,并被用于训练更抗提示注入的 GPT-5.6。OpenAI 官方说明
漫画梗点:以前是人类给模型找漏洞,现在模型自己来当压力测试员。
2. Codex Micro:OpenAI 首件硬件是键盘
OpenAI 7 月 15 日发布与 Work Louder 联合设计的 Codex Micro,售价 230 美元,是一块用来监控和管理 Codex AI 代理的限量键盘。它带有显示代理状态的按键、可编程快捷键、摇杆和调节推理强度的旋钮。TechCrunch 报道 The Verge 报道
漫画梗点:AI 还没替你写完代码,先有一块键盘来管理它的状态灯。
3. Google:欧盟要求 Android 和搜索给竞品开门
欧盟委员会 7 月 16 日公布两组具有约束力的 DMA 措施:Google 要向竞品 AI 助手开放 Android 的 11 项功能,未来用户可以把 ChatGPT、Claude 等助手接得更深;Google 还要向 OpenAI 等搜索型 AI 共享经过匿名化处理的搜索数据。Android 相关变化预计从 2027 年 7 月起生效,搜索数据共享从 2027 年 1 月起实施。Google 认为这可能伤害隐私和安全。Reuters 报道 The Verge 报道
漫画梗点:Gemini 还在自己家当主角,欧盟先把客厅钥匙发给竞争对手。
4. 微软:给销售团队开一堂竞品吐槽课
据 Bloomberg 报道,微软在新财年内部会议上培训销售团队,强调自家模型的成本、安全和整合优势,并把 Claude 描述为在微软办公应用里「更慢、更不准确、缺少适当的安全集成」。TechCrunch 还指出,微软长期依赖 OpenAI 和 Anthropic 的模型为自己的产品提供能力,近期则在 Word、Excel 等应用中更多换用自研模型。Bloomberg 报道 TechCrunch 报道
漫画梗点:一边给竞品写差评,一边还得承认对方曾是自家 AI 的发动机。
5. AI 安全榜:最高分也只有 C+
Future of Life Institute 的 Summer 2026 AI Safety Index 给 9 家主要 AI 公司打分:Anthropic 以 C+ 排第一,OpenAI 和 Google DeepMind 为 C,Meta 为 D+,xAI、DeepSeek 和 Mistral 为 F。该指数说明,整体证据收集截至 6 月 3 日;在「存在性安全」这一分项上,没有公司高于 C-。官方榜单
漫画梗点:行业都在冲前沿,成绩单却像全班还在补考安全。




댓글
로그인하면 댓글을 작성할 수 있습니다.