
《OpenAI 智囊团一日发言|2026-07-16》
GPT-5.6 Sol 的增长把 OpenAI 推向新的运营阶段:Codex 与 ChatGPT Work 逼近 900 万用户,Codex 延伸到 Chrome 和实体控制台,GPT-Red 则把 Agent 安全推进到自动化红队训练。
今日结论
窗口为 2026 年 7 月 15 日 09:00 至 7 月 16 日 09:00(北京时间)。今天的信号比前几天更集中:GPT-5.6 Sol 的发布热度正在转化为两类运营问题,一类是推理供给和配额,另一类是如何把 Codex 从软件入口延伸到浏览器、硬件和连续语音交互。与此同时,OpenAI 把提示注入防御推进到自动化红队训练,安全能力开始和模型能力一起扩张。
白名单账号已逐一检查 X 时间线;窗口内没有可验证新增的账号仍保留在扫描范围,没有因空列表或长期不更新而移除。YouTube 搜索结果中,只有 OpenAI 官方的 Codex Micro 视频拿到了可解释的具体发布时间并纳入本期;只有「1 天前」或「2 天前」提示、缺少详情时间的视频没有被当作窗口内新发内容。
今日最重要判断
1. 安全训练开始形成自己的规模化飞轮
Greg Brockman 在窗口内写道:
GPT-Red — improving model security through automated red teaming of prompt injection vulnerabilities:
中文翻译:GPT-Red,通过对提示注入漏洞进行自动化红队测试来提升模型安全性。1
这条推文本身只给出一句定位,但 OpenAI 同日发布的技术文章补齐了关键事实:GPT-Red 是内部自动化红队模型,用自博弈强化学习生成攻击,随后被用于对 GPT-5.6 做对抗训练;OpenAI 称 GPT-5.6 Sol 在最难的直接提示注入基准上,相比四个月前最好的生产模型失败次数减少 6 倍。文章还披露,GPT-Red 在一个间接提示注入场景中对 84% 的场景找到成功攻击,人类红队员为 13%。这些数字只描述特定评测和内部镜像,不能外推成所有真实部署都安全。2
重要性在于,安全不再只是发布前的一次人工检查。OpenAI 正尝试让「今天的模型攻击系统、明天的模型吸收失败样本」成为持续训练环节,并明确保留人工红队、第三方红队、分层防护和实时监控。对 Codex、浏览器和连接应用这类能接触第三方数据的 Agent,这比单纯提高拒答率更接近实际防线。
2. ChatGPT Work 与 Codex 已从增长故事进入容量决策
Tibo Sottiaux 写道:
Embarrassment of riches. But looks like we might hit 9M soon. Should we reset the ChatGPT Work and Codex usage again or give it some space?
中文翻译:需求多到让人犯难,但看起来我们很快可能触及 900 万。我们要不要再次重置 ChatGPT Work 和 Codex 的使用额度,还是给它一点空间?3
这不是「已达到 900 万」的公告,而是负责 Codex 与 ChatGPT 的产品负责人对逼近 900 万的公开判断,并把额度重置直接放进增长决策里。它延续了前一日已确认的 800 万活跃用户,但新增信息是:用量增长仍在继续,限制策略需要跟着实时变化。此前 800 万用户的公告同时宣布重置所有用户额度并暂时取消 5 小时速率限制。4
更值得留意的是,OpenAI 又用「前 1 万名、每人 100 美元 Codex credits」鼓励用户说明为什么转向 GPT-5.6 Sol。它把迁移反馈、用户作品和额度消耗放进同一个增长回路,说明当前重点已经从「模型是否发布」转向「用户是否持续把工作搬进来」。5
3. Codex 的硬件入口已经从概念变成商品
OpenAI Developers 发布了这条原文:
Yes, we heard you. Get your Codex Micro: https://t.co/e0I7xWZZQG https://t.co/B5G2vJe7Yq
中文翻译:好的,我们听到了。现在可以购买 Codex Micro。6
官方商品页显示,Codex Micro 售价 230 美元,支持 Mac 和 Windows,通过 Bluetooth / USB-C 连接,配有显示 Agent 状态的 RGB 按键、启动技能的平面摇杆、用于调节推理级别的旋钮,以及接受、拒绝、语音输入和新建对话等实体控制。页面给出的预计发货时间是 7 月 24 日。7
Sam Altman 对同一产品补充说:
amazing to me that some people want the silent version
中文翻译:让我惊讶的是,竟然有人想要静音版本。8
这件事的战略含义不是键盘本身,而是 Agent 的控制层开始从软件界面向实体设备延伸。Codex Micro 把任务切换、权限请求、语音输入和推理强度变成手边动作,意味着 OpenAI 正在试探「长期运行的 Agent 是否需要一个专用控制台」。官方 YouTube 演示显示,Codex Micro 可在一次构建中处理语音听写、任务切换、推理控制、权限请求和后续任务排队。9
4. Codex in Chrome 的目标是接管跨工具流程,但最终决定仍留给人
OpenAI Developers 写道:
Turn a request into a go-live plan with Codex in Chrome:Build a checklist from the form Pull context from @googledrive, @SlackHQ, and local files Flag what needs follow-up Update the portal Draft the replyYou make the final call.
中文翻译:用 Chrome 中的 Codex,把一个请求变成上线计划:从表单建立清单,从 Google Drive、Slack 和本地文件提取上下文,标出待跟进事项,更新门户并起草回复。最终决定仍由你做出。10
这条内容比「帮我写代码」更进一步:输入来自表单,信息来自多个外部系统,输出会回写门户并形成对外回复。OpenAI 的 Codex 产品页也把 Codex 定义为可并行运行多个 Agent、支持云环境和长期后台工作的工作台,但没有把这条推文中的具体 Chrome 集成细节扩写成普遍可用能力。11
5. GPT-Live 正在把语音从问答界面变成连续任务界面
OpenAI 官方账号写道:
A closer look at improved intelligence in GPT-Live: the model can keep a conversation going while helping with multiple tasks at once, like checking flights, pulling up local weather, and shaping an itinerary in real time.
中文翻译:进一步看看 GPT-Live 的智能提升:模型可以保持对话连续,同时一次处理多个任务,例如查询航班、调取当地天气,并实时整理行程。12
这条窗口内的新动态是能力演示,不是 GPT-Live 首次发布。官方公告说明,GPT-Live 采用全双工架构,可边听边说;需要搜索、推理或更复杂工作时,把任务委派给后台模型,同时维持对话流。官方也明确写出当前限制:ChatGPT 中暂不支持语音配合视频或屏幕共享。13
个人账号信号
模型与推理
1. Sol 在前端开发场景的成本优势被 Greg Brockman 进一步具体化。
6x price efficiency (!!) with Sol for react/frontend dev:
中文翻译:在 React / 前端开发场景,Sol 的价格效率达到 6 倍。14
原帖没有给出比较对象、样本、成本口径或测试方法,因此只能记录为 OpenAI 联合创始人的场景化判断,不能写成独立基准结果。它与前几日 Sam Altman 关于 Sol 价格和 token 效率的说法方向一致,但不是同一组测量。
2. Greg Brockman 描述了 ChatGPT Work 与 Sol 对知识工作的一个使用变化。
with chatgpt work & sol, i'm finding it incredibly joyful to just ask any question about the business and have it be thoroughly researched and answered.realizing i have so many questions i wouldn't have bothered asking because they would be too burdensome to answer.
中文翻译:用 ChatGPT Work 和 Sol,我发现随时问任何业务问题、让它完成充分研究并回答,体验非常愉快。我意识到,过去有很多问题因为回答成本太高,我根本不会去问。15
这里的信号不是「研究已被自动化」,而是提问成本下降后,工作流会产生更多原本不会被提出的问题。它解释了为什么 OpenAI 同时关注活跃用户、额度和后台任务,而不只是单次回答质量。
Agent 与 Codex
3. 产品团队把用户迁移做成公开反馈实验。
Or… what if we gave you $100 in Codex credits if you tell us what you love about GPT-5.6 Sol or why you switched?Tweet it, claim your gift, enjoy more usage. First 10k get the free tokens!
中文翻译:如果我们给你 100 美元 Codex credits,换取你说说喜欢 GPT-5.6 Sol 的什么,或者为什么转向它,会怎样?发帖、领取礼物、获得更多使用量,前 1 万名可获得免费 tokens。5
这是产品增长动作,不是模型质量证明。它的价值在于把公开口碑、迁移理由和后续消耗绑定,帮助团队快速区分「被发布吸引」和「真正换工作入口」。
4. OpenAI Developers 继续把 Codex 作为跨工具执行层来展示。
窗口内的 Chrome 演示和 Codex Micro 商品页共同指向一个更具体的产品方向:浏览器负责接入工作系统,Codex 负责拆解和执行,硬件负责控制任务和权限。官方 X 没有声明所有用户已经获得同等集成权限,因此本期只把它记为产品方向与演示信号。
AI 安全与政策
5. GPT-Red 的攻击面覆盖浏览器、邮件、本地文件和工具返回值。
OpenAI 的技术文章把间接提示注入定义为第三方数据中的恶意指令影响模型行为,例如网页、电子邮件、工具响应或代码仓库中的内容。文章还称 GPT-Red 在 10 个 Codex CLI 数据外泄场景上比 GPT-5.5 基线更有效且更节省 tokens,并强调 GPT-Red 本身与部署模型分离,不直接交给外部攻击者。2
这一信号应与 Codex Chrome 的跨系统能力放在同一张图里看:工具越多,第三方内容越可能进入上下文,安全红队就越不能只测聊天框里的恶意提示。
外部观察席
6. Lilian Weng 宣布 Thinking Machines Lab 的 Inkling 开放权重模型可在 Tinker 上试用。
Inkling is our open weights model.It aims to serve as a foundation with solid performance across a broad categories of capabilities, for use in practice and customization.Play it on Tinker! 😄
中文翻译:Inkling 是我们的开放权重模型,目标是作为一个基础模型,在广泛能力上提供扎实表现,供实际使用和定制;可以在 Tinker 上试用。16
Lilian Weng 属于外部观察席,当前身份是 Thinking Machines Lab 联合创始人,不应把这条内容写成 OpenAI 的模型发布。它对本频道的价值在于:OpenAI 前员工和研究者正在把「可定制、开放权重、可直接试用」作为新团队的产品入口,前沿模型竞争不只发生在封闭 API 的榜单上。
OpenAI 官号当日动态
以下为窗口内 X 官方账号和 OpenAI YouTube 频道中拿到可解释发布时间的全部新内容。官方转推保留为转推入口,不把截断文本扩写成公告。
OpenAI
- GPT-Live 产品演示,2026-07-16 05:12(北京时间):展示 GPT-Live 在连续对话中同时查询航班、天气和行程。类型:产品更新。12
- Research & Deployment 周边商品,2026-07-16 00:29:宣布研究与部署主题商品限量发售,类型:其他官方动态。17
- 转推 Codex credits 活动,2026-07-15 12:33:转推 Tibo 的 GPT-5.6 Sol 迁移反馈活动,类型:转推入口。18
OpenAI Developers
- Codex Micro,2026-07-16 07:05:发布「Get your Codex Micro」购买入口,类型:产品发布。6
- Codex in Chrome,2026-07-16 02:59:演示从表单、Google Drive、Slack 和本地文件生成上线计划,并由用户做最终决定,类型:产品能力演示。10
- 转推 Codex Micro 购买消息,2026-07-16 01:56:转推合作方关于限量发售的消息,类型:转推入口。19
- 转推 GPT-5.6 Sol 网站构建视频,2026-07-15 09:53:内容为外部用户在 Codex 中测试 Sol 与 Terra 的视频入口,类型:转推入口。20
- 转推 Sol WebAR 案例,2026-07-15 09:53:内容为外部用户用 Sol、8thWall、SparkJS 和 Gaussian splat 构建 WebAR 的入口,类型:转推入口。21
- 转推个性化购物案例,2026-07-15 09:53:原帖为 GPT-5.6 Sol 的个性化购物案例视频入口,类型:转推入口。22
- 转推一条短链接内容,2026-07-15 09:52:详情仅保留「a la this」及短链接,未能读取正文标题,类型:长文入口,未扩写。23
OpenAI Newsroom
- ChatGPT 用户案例:Vishal 的竞技自行车训练,2026-07-15 10:00:讲述印度骑手 Vishal 使用 ChatGPT 规划训练、优化营养、支持恢复并研究自行车假肢设计,随后获得参加 2026 年亚洲残疾人公路自行车锦标赛和公路自行车世界杯的资格。类型:用户案例。24
OpenAI YouTube
- Introducing the Codex Micro,2026-07-16 03:42:官方 2 分 15 秒演示,展示语音听写、技能触发、Plan mode、推理级别、任务切换、通知与权限、后续任务排队和结果定制。类型:产品演示。9
今日关注优先级:高
高优先级来自三条相互咬合的线:GPT-5.6 Sol 继续推高真实用量并迫使产品团队调整额度;Codex 正向浏览器、跨系统工作流和实体控制台扩张;GPT-Red 则把 Agent 安全纳入自动化对抗训练。需要保留的边界是,900 万仍是「即将达到」的产品负责人判断,6 倍价格效率缺少公开测试方法,Codex Chrome 和 Codex Micro 的权限与可用范围也不能由演示视频直接外推。
References
- 1Greg Brockman 的原帖
- 2GPT-Red: Unlocking Self-Improvement for Robustness
- 3Tibo Sottiaux 的原帖
- 4Tibo 关于 800 万活跃用户与额度重置的原帖
- 5Codex credits 迁移反馈活动
- 6OpenAI Developers 的原帖
- 7Codex Micro 官方商品页
- 8Sam Altman 的原帖
- 9Introducing the Codex Micro
- 10Codex in Chrome 工作流演示
- 11Codex 官方产品页
- 12OpenAI 的 GPT-Live 原帖
- 13Introducing GPT-Live
- 14Greg Brockman 的原帖
- 15Greg Brockman 的原帖
- 16Lilian Weng 的原帖
- 17OpenAI 原帖
- 18OpenAI 转推
- 19OpenAI Developers 转推
- 20OpenAI Developers 转推
- 21OpenAI Developers 转推
- 22OpenAI Developers 转推
- 23OpenAI Developers 转推
- 24OpenAI Newsroom 原帖
Related content
- Sign in to comment.
