《OpenAI 智囊团一日发言|2026-08-07》

《OpenAI 智囊团一日发言|2026-08-07》

本期梳理 GPT-5.6 在 ChatGPT 中的访问边界、Agent Plugins 跨客户端标准、Codex Security Review 研究预览,以及 OpenAI 与美国心理学会的青少年心理健康合作。

本期窗口:2026-08-06 09:00 至 2026-08-07 09:00(Asia/Shanghai)。白名单内 41 个 X 账号逐一检查了窗口内容;白名单人物过去 48 小时的 YouTube 候选也用视频详情的绝对发布时间复核。未发现可验证的窗口内新访谈、演讲、播客或 OpenAI 官方频道新视频。今天的高价值信号集中在四个变化:ChatGPT 的模型与套餐边界重新划分,Agent Plugins 开始把扩展做成跨客户端标准,Codex 把安全审查放进 GitHub PR,OpenAI 则把青少年心理健康合作推进到心理学专业机构。

今日最重要判断

1. GPT-5.6 Sol 在 ChatGPT 中统一了 Instant 与深度推理,但 Work 和 Codex 暂时留在另一条版本线上

OpenAI 的窗口内主帖把两件事放在同一条公告里:Plus、Pro 用户的 GPT-5.6 Sol 同时驱动 Instant 和深度推理;Free、Go 用户获得 GPT-5.6 Luna 的无限文本聊天。1
原文:
We’re making better intelligence easier to access in ChatGPT for everyone:
  • GPT-5.6 Sol now powers both Instant and deep reasoning for Plus & Pro users, delivering more factual, focused responses.
  • Free & Go users get unlimited text chats with GPT-5.6 Luna starting tomorrow.
中文翻译:
我们正在让每个人都更容易在 ChatGPT 中使用更好的智能:
  • GPT-5.6 Sol 现在同时为 Plus 和 Pro 用户提供 Instant 与深度推理,回答更准确、更聚焦。
  • Free 和 Go 用户从明天起可无限使用 GPT-5.6 Luna 进行文本聊天。
Loading content card…
同一组官号帖文还写明,Plus、Pro 用户获得 reasoning slider;这次更新只进入 ChatGPT 的 Chat 体验,支持 Work 和 Codex 的 GPT-5.6 Sol 不变。2 OpenAI 的产品说明进一步确认,滑杆面向 web、移动端和桌面端,目的是让用户在速度与 planning、research、writing、coding 之间调节投入的推理时间。3
为什么重要:这不是一次简单的模型替换。ChatGPT 的日常对话正在把「快速回答」和「多花时间推理」收进同一模型体验,但 Work、Codex 仍保持独立版本边界。读者要把「ChatGPT 更新」与「工作流 Agent 的底层版本」分开看,不能因为 Chat 里换了 Sol,就推断 Work 或 Codex 同步换代。

2. Agent Plugins 把 Skills 和 MCP 的分发问题,推进到跨客户端标准层

OpenAI Developers 的主帖写道:
Build a plugin once and use it across compatible agent clients.
Introducing Agent Plugins, an open standard developed with @awsdevelopers, @cursor_ai, @github, @code, and @vercel that packages Agent Skills and supports MCP server configurations in a shared format.
中文翻译:
开发一次插件,就能在兼容的 Agent 客户端之间使用。
现推出 Agent Plugins。这是一项与 AWS、Cursor、GitHub、VS Code 和 Vercel 共同开发的开放标准,用统一格式打包 Agent Skills,并支持 MCP 服务器配置。
Loading content card…
第二条帖文列出首批兼容客户端:Codex、ChatGPT、Cursor、GitHub Copilot、Kiro 和 VS Code。4 AWS 的同期说明把 Agent Plugins 1.0.0 定义为开源、厂商中立的打包规范:一个插件目录包含 JSON manifest,可声明身份和入口;客户端按约定发现 skills/ 与 MCP 配置。安装、展示和分发方式仍由各客户端决定,hooks、sub-agents 等扩展留给后续版本。5
为什么重要:Agent 生态的摩擦点从「模型会不会调用工具」转向「同一套扩展能不能带走」。这条标准若被更多客户端采用,开发者不必为每个 Agent 重新改写 Skills 和 MCP 连接;但首版只解决打包互操作,不等于权限、安装审核和分发市场已经统一。

3. Codex Security Review 进入研究预览:代码审查开始读取 PR 之外的仓库上下文

OpenAI Developers 的原文:
Now in research preview: Codex Security Review
It takes a deeper look at GitHub pull requests for security issues, using repository context to surface actionable findings directly in the PR.
See how to enable automatic reviews: https://t.co/OUm6Sq2ZaC https://t.co/Ut55Vg3lPO
中文翻译:
现进入研究预览:Codex Security Review。
它会利用仓库上下文,更深入地检查 GitHub pull request 中的安全问题,并直接在 PR 中呈现可执行的发现。
查看如何启用自动审查:见原帖中的两个链接。
Loading content card…
OpenAI 的 Codex Security 文档写明,Security Review 会同时分析 PR diff、仓库上下文和配置的 threat model 或安全指导;可在 PR 打开、每次 push 或 Code Review 运行时自动触发,也可以在 PR 中评论 @codex security review 手动触发。当前可用范围是 Enterprise、Business、Edu 和 Pro,Plus 不在文档列出的范围内。6 Greg Brockman 随后补充,Codex 可以为每个 GitHub PR 做安全审查并把发现写回 PR。7
为什么重要:这项功能把安全审查从差分级别推向仓库级别,但它仍是研究预览。文档还提醒,发布到 GitHub 的 findings 会继承 PR 的可见性,能查看 PR 的人都可能看到;reporting threshold 只控制哪些发现发布到 GitHub,完整报告仍留在 Codex 中。安全团队要先检查 threat model、PR 可见范围和报告阈值,再决定是否自动开启。

4. OpenAI 把青少年心理健康的产品防护,交给心理学专业机构共同定义

OpenAI Newsroom 的原文:
We’re working with the American Psychological Association to bring psychological science and clinical expertise into our work on AI and youth mental health.
Together with the @APA, we’ll develop evidence-based guidance, resources, and safeguards to help ensure AI supports young people’s well-being and healthy development.
中文翻译:
我们正在与美国心理学会合作,把心理学科学和临床专业知识带入 AI 与青少年心理健康相关的工作。
我们将与 APA 一起制定基于证据的指导、资源和防护措施,帮助确保 AI 支持青少年的福祉与健康发展。
Loading content card…
OpenAI 的正式说明把合作范围落到四个场景:青少年处于情绪困扰或危机时如何连接现实世界支持;如何让 AI 更符合青少年发展阶段;如何帮助家长、照护者、临床医生和学校心理学家识别需要成人介入的情况;以及通过与青少年、家庭和专业人员讨论,了解真实使用中的风险。8
为什么重要:这条信号不是一个新按钮,而是安全规则的生产方式变化。后续更值得看的是合作是否公开具体指导、升级路径和评估指标,而不是只看合作新闻本身。

模型与推理

本窗口没有白名单个人账号发布新的可核验模型规格、基准成绩或研究论文。GPT-5.6 Sol 的 ChatGPT 版本更新已在「ChatGPT 产品更新」专区集中呈现,不在这里重复。

Agent / Codex

1. Agent Plugins:OpenAI 负责把扩展格式推到客户端之间

这条信息由 OpenAI Developers 的两条官号帖文、AWS 的技术说明和 Codex 团队成员 Tibo 的转发式评论共同构成,但它们属于同一事件。OpenAI 的公开口径是一次打包、跨兼容客户端使用;AWS 则补充了目录、manifest、Skills 和 MCP 配置的技术边界。59
Andrew Ambrosino(@ajambrosino,Codex & Chat @OpenAI)在窗口内转发了主帖;这是传播信号,不是另一项标准。10

2. Security Review:从发布功能进入使用量观察

除官方发布外,Jason(@jxnlco,个人简介标注 vibes @openai)在窗口内询问开发者是否使用 auto review,并请求分享使用曲线。11 这不能证明功能已经稳定覆盖所有账户,却说明团队已经开始收集真实使用反馈。判断功能能否进入生产流程,仍要回到研究预览的套餐、触发方式、威胁模型和 PR 可见性边界。

3. Codex 用量压力仍在直接影响产品运营

Tibo(@thsottiaux,Codex & ChatGPT @OpenAI)写道:
I asked Codex to pull up some stats and I receive on average one DM or email every 6 or so minutes to ask for a reset. I occasionally do oblige if it comes with really solid feedback or banter.
中文翻译:
我让 Codex 调出一些统计:平均每隔大约 6 分钟,我就会收到一条私信或邮件,请求重置额度。如果反馈特别扎实,或者玩笑讲得很好,我偶尔会答应。
这条帖文发布于 2026-08-06 12:28(北京时间)。12
这是产品团队成员描述的运营压力和个人处理方式,不是公开的统一额度政策。它能确认的是,使用强度已经让额度重置成为高频反馈入口;不能据此推断任何套餐的具体额度或重置资格。

4. /goal 被产品团队成员描述为 GPT-5.6 Sol 的 Codex 工作循环

Tibo 在另一条窗口内帖子中建议用户探索 Codex 的 /goal,称它是「a pretty powerful loop with GPT-5.6 Sol」。13 帖文没有给出命令的完整定义、适用账户或发布说明,所以它应被标为团队成员的使用建议,而不是新功能规格。

5. Codex 团队出现新增成员信号,但职责尚未公开

Andrew Ambrosino 写道:
very excited to welcome @nikitabier to the codex team
中文翻译:
非常高兴欢迎 Nikita Bier 加入 Codex 团队。
14

6. Codex Voice 出现机器人反馈回流的员工使用演示

Jason 写道:
Codex voice mode building a robot harness
the robot is giving feedback about its capabilities back into voice mode…
Amazing.
中文翻译:
Codex 的语音模式正在构建一个机器人 harness。
机器人把关于自身能力的反馈回传到语音模式中……
很惊艳。
15

产品与应用

7. 当前 Agent 产品的瓶颈,可能先是让用户理解 computer use

Gabriel(@gabriel1,个人简介标注曾在 OpenAI 和 Midjourney 做研究、当前为创业者)在窗口内连续解释自己的产品判断:他说在旧金山之外,真正把 AI 用于全部工作的知识工作者不到 0.1%;不到 1% 的人对 computer use 能为工作做什么有直觉,因此现在上线的理由是市场仍近乎空白,接下来要通过公开构建摸索如何让另外 99% 的人上手。1617
这是外部观察席的创业者判断,不是 OpenAI 的产品公告,也没有提供上述比例的调查方法。它对读者的价值在于指出一个容易被忽略的比较维度:Agent 的竞争不只在模型能力,还在用户是否知道该把什么工作交给它。

8. /visualize 与 Chief of Staff 线程显示了自然语言到可视化结果的使用方式

Jason 说,自己有一个固定的旅行线程,可以让 Chief of Staff 使用 /visualize 来呈现行程,并称 Skills 可以生成内嵌可视化。1819 这仍是个人使用案例,不等于所有用户都能使用同样的命令或可视化组件;它展示的路线是把自然语言线程变成可持续维护的工作界面。

商业化与组织

9. Codex 的组织信号:新成员、额度反馈与跨客户端标准同时出现

本窗口没有新增融资、财务数据或价格公告。可以确认的组织与商业化信号有三条:Codex 团队迎来 Nikita Bier;团队成员每天处理高频额度重置请求;Agent Plugins 试图降低开发者跨客户端迁移扩展的成本。它们分别对应团队扩张、用量运营和开发者生态,不应合并成收入或用户规模结论。51214

AI 安全与政策

10. APA 合作把青少年安全从模型回应,扩展到家庭、学校和临床场景

OpenAI Newsroom 的窗口内帖文与正式说明属于同一条官号动态,已在「今日最重要判断」中引用。正式说明还提到 OpenAI 过去与 260 多位心理健康专家合作、改进困境信号识别和危机资源;这些是背景,不是本窗口新上线的单独功能。8

外部观察席

11. Jerry Tworek:Meta 的 AI 进展正在改变外部实验室排序

Jerry Tworek(@MillionInt,前 OpenAI 强化学习副总裁、现 CoreAutoAI 联合创始人)写道,他起初怀疑 Meta 是当前第三好的 AI 实验室,但每天都更确信这个判断,认为 TBD strategy 已经成功。20
这是前 OpenAI 研究管理者的外部观点,不是 OpenAI 内部信源,也没有给出「第三好」的评价指标。它可作为竞争环境观察,不足以支撑模型能力排名。

ChatGPT 产品更新

本窗口内 @OpenAI 连续发布 5 条互相关联的官号内容,以下逐条保留:
  • 2026-08-07 02:35|产品发布:GPT-5.6 Sol / GPT-5.6 Luna。Plus、Pro 用户的 Sol 同时用于 Instant 和深度推理;Free、Go 用户获得 Luna 无限文本聊天。1
  • 2026-08-07 02:35|产品发布:事实性评估。OpenAI 称,新版 GPT-5.6 Sol 在覆盖金融、医疗和法律的高风险事实性评估中,相比 GPT-5.5 Instant 少出现 68% 的事实错误回答。21 这是 OpenAI 自己的评估口径,不等于所有真实场景都减少 68% 错误。
  • 2026-08-07 02:35|产品发布:Think 按钮。OpenAI 称 Free、Go 用户可以使用 Think 按钮,让 GPT-5.6 Luna 对较难问题投入更多推理时间。22
  • 2026-08-07 02:35|产品发布:reasoning slider。Plus、Pro 用户获得滑杆,可选择 ChatGPT 对每个回答投入多少推理 effort。23
  • 2026-08-07 02:35|产品发布:Chat、Work、Codex 边界。更新版 Sol 与新滑杆从 ChatGPT 的 Chat 体验开始,支持 Work 和 Codex 的 GPT-5.6 Sol 不随此次发布改变。2
Greg Brockman(@gdb)在 03:07 转发并补充,Luna 面向免费用户提供无限文本聊天,Sol 把快速聊天和深度推理合并到同一模型体验中。24 Sam Altman(@sama)在 03:56 简短评价新版 Sol「much better in chat」,并再次提到免费用户的无限文本聊天。25
有一处时间口径需要保留:OpenAI X 帖文写 Think 按钮「starting tomorrow」,产品说明写 Free 用户「starting next week」;因此本期只把功能范围作为已确认事实,不把按钮的具体上线日写死。产品说明还指出,Free 用户的文件上传、图片和其他工具仍有额度限制。3

OpenAI 官号当日动态

@OpenAI

  • 2026-08-07 02:35|产品发布。GPT-5.6 Sol 进入 Plus、Pro 用户的 Instant 与深度推理,GPT-5.6 Luna 面向 Free、Go 用户提供无限文本聊天。1
  • 2026-08-07 02:35|产品发布。OpenAI 发布新版 Sol 的高风险事实性评估口径,称相比 GPT-5.5 Instant 少 68% 的事实错误回答。21
  • 2026-08-07 02:35|产品发布。Free、Go 用户可使用 Think 按钮,让 Luna 对难题投入更多推理时间。22
  • 2026-08-07 02:35|产品发布。Plus、Pro 用户可用 reasoning slider 调节推理 effort。23
  • 2026-08-07 02:35|产品发布。本次更新限于 Chat 体验,Work 与 Codex 使用的 GPT-5.6 Sol 不变。2

@OpenAIDevs

  • 2026-08-07 00:11|产品发布 / 开发者标准。发布 Agent Plugins,主张一次打包、在兼容 Agent 客户端之间使用,标准覆盖 Agent Skills 和 MCP 配置。9
  • 2026-08-07 00:11|产品发布 / 开发者标准。列出首批兼容客户端:Codex、ChatGPT、Cursor、GitHub Copilot、Kiro 和 VS Code。4
  • 2026-08-07 05:45|产品发布。Codex Security Review 进入研究预览,可读取仓库上下文并在 GitHub PR 内留下安全发现。26

@OpenAINewsroom

  • 2026-08-07 01:40|AI 安全与政策。宣布与美国心理学会合作,为青少年心理健康相关的 AI 使用制定基于证据的指导、资源和防护措施。27

YouTube @OpenAI

过去 48 小时未发现能用视频详情页绝对发布时间验证的新视频或直播回放。搜索结果里混有旧访谈、第三方解读和无明确时间字段的条目,未纳入官号动态。

今日关注优先级

高。
今天有三个可直接落地的观察点:ChatGPT 把模型访问与推理 effort 合并到更简单的 Chat 体验,但 Work/Codex 版本边界没有跟随;Agent Plugins 开始把 Skills 与 MCP 的可移植打包问题交给跨公司标准;Codex Security Review 则把仓库上下文带入 PR 安全审查,同时把套餐、权限和可见性留在研究预览阶段。下一次应优先核对三件事:Think 按钮实际何时完成分批开放,Agent Plugins 的安装与审核是否形成共同规则,以及 Security Review 在真实 PR 中的误报、报告阈值和敏感信息处理效果。
OpenAI 智囊团一日发言

OpenAI 智囊团一日发言

每日追踪 OpenAI 及前沿 AI 领域关键人物的 X/Twitter 发言,自动筛选高价值判断信号,按主题归类呈现行业含义。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

  • Sign in to comment.
More from this channel