OpenAI 8月25日至26日动态:Jalapeño首批实测,ChatGPT定时任务可响应应用事件

OpenAI 8月25日至26日动态:Jalapeño首批实测,ChatGPT定时任务可响应应用事件

本期梳理 Jalapeño 推理芯片首批实测、ChatGPT 定时任务事件触发与 Work 浏览器登录能力,以及数据中心负责人 Chris Malone 离职,并标出 API 与状态页核验结果。

速览

本期覆盖 2026 年 8 月 25 日 09:00 至 8 月 26 日 09:00(北京时间)。窗口内有三条主线:OpenAI 公布自研推理芯片 Jalapeño 的首批实测结果,并同步放出 CFO Sarah Friar 的全栈算力说明;ChatGPT Release Notes 与 Codex 周报同日写入定时任务事件触发、浏览器登录站点等产品更新;CNBC 与 Bloomberg 确认数据中心负责人 Chris Malone 已离职。API Changelog 与 Status History 在窗口内没有新的日期级条目。1234
条目窗口内时间读者先看什么
Jalapeño 首批实测OpenAI News RSS 显示为 8 月 25 日 15:00自研推理芯片在 InferenceX 上给出吞吐与延迟数据;OpenAI 计划年底前在自有基础设施中部署。15
全栈算力配套说明OpenAI News RSS 显示为 8 月 25 日 15:05CFO Sarah Friar 把芯片结果放进算力组合、成本与供应策略。25
ChatGPT / Codex 产品更新Release Notes 与 Codex 周报标注 8 月 25 日定时任务可响应 Gmail、Slack、GitHub 事件;ChatGPT Work 浏览器支持在已登录网站继续完成任务。36
Chris Malone 离职CNBC 报道发布于 8 月 26 日 05:23数据中心负责人离职;OpenAI 称已重组基础设施组织。4

Jalapeño 给出首批推理实测

OpenAI 在北京时间 8 月 25 日 15:00 发布工程公告,公布自研推理芯片 Jalapeño 的首批测量结果。公告写明,Jalapeño 是 OpenAI 的第一款定制推理芯片;团队在围绕这枚芯片搭建的系统上完成测试后,认为它能在同一架构里同时提高吞吐并降低延迟。15
测试基准是 SemiAnalysis 的公开基准 InferenceX,覆盖从高吞吐服务到低延迟交互的工作区间。OpenAI 比较了 GPT‑OSS 120B、DeepSeek R1 和 Kimi K2.5 1T 三类模型。公告给出的汇总区间是:峰值吞吐下,单位功耗可完成的 AI 工作量约为对比系统的 1.5 到 1.9 倍;端到端延迟约为对比系统的 1.7 到 3.6 倍更低;高交互负载下性能约为对比系统的 2.1 到 4.1 倍。OpenAI 还写到,芯片标称功耗为 700 瓦,在所测工作负载上的持续功耗不超过 550 瓦1
公告附录给出了更细的工作点。以 GPT‑OSS 120B 为例,OpenAI 写到峰值混合吞吐约为 85,448 mixed TPS/kW,对比系统约为 44,960;端到端延迟约为 1.03 秒1.80 秒。DeepSeek R1 与 Kimi K2.5 条目同样给出峰值吞吐、端到端延迟和最低 token 间隔等数字。这些数字来自 OpenAI 按各加速器公开芯片功耗额定值做归一化后的厂商测试说明,不是独立第三方复测报告。1
架构上,OpenAI 把增益归因于把芯片、内存、网络、软件和机架级系统一起围绕语言模型工作负载设计,尽量减少 prefill、decode 和跨芯片通信时的数据搬移。公告还写到,团队用 AI 把芯片从初始设计推进到 tapeout 用了 9 个月;借助 Codex 与 GPT‑Astra,又在约 两个月 内把三个原本不在量产计划中的开源权重模型调到较高性能。对选定的 GPT‑OSS attention 与 mixture-of-experts 模块,AI 生成实现比原有人工专家实现快 1.5 到 1.8 倍;公告写明这些数字只覆盖选定模块。1
部署时间表是读者现在就能记下的边界。OpenAI 计划在 今年年底前 开始在自有算力基础设施中部署 Jalapeño,并称第二代已在深入开发、第三代也在成形。公告同时写明,OpenAI 会继续广泛部署 NVIDIA 及其他合作伙伴的加速器,用于训练和推理。对客户而言,这是 OpenAI 自述的首方硅路线图,还不是对外销售的芯片产品或可下单的云实例规格。1
基础设施和成本团队如果要跟进,最短动作是把公告里的三类模型、功耗归一化方式和部署时间线记进算力评估表,再对照自家延迟、吞吐和单位成功任务成本,而不是只抄峰值倍数。

CFO 把芯片结果放进全栈算力说明

同一窗口,OpenAI News RSS 在北京时间 8 月 25 日 15:05 放出 CFO Sarah Friar 的配套文章《The full stack behind abundant intelligence》。文章把 Jalapeño 的首批结果放进 OpenAI 的算力策略:数据中心与芯片、前沿模型、开发者平台、消费与企业产品,以及 AI 原生设备被视为同一套系统。25
Friar 写到,OpenAI 的算力组合除了微软算力和 NVIDIA 芯片,还包括 AWS、AMD、Broadcom、Cerebras、CoreWeave、Oracle、SB Energy 和 SoftBank。文章把这条组合解释为在能力与经济性之间做主动管理:在能力要求高的工作负载上使用更高规格系统,在规模和成本更敏感的地方优化效率。文章还提到佐治亚州的 Project Camellia,作为围绕客户工作负载设计数据中心的例子。2
在模型侧,文章引用 Artificial Analysis Coding Agent Index,称 GPT‑5.6 Sol 在最大推理设置下达到新高,同时输出 token 比另一领先模型少 54%。这个数字是 OpenAI 文章里的厂商口径,读者需要回到具体基准页面核对对比对象与设置。2
对投资观察者和企业采购团队,这篇配套文的价值在于把芯片公告翻译成供应与成本叙事:自研硅是杠杆,合作伙伴加速器仍是主力,效率改善要落到“完成一次有用任务的总成本”。它没有给出新的对外售价、SLA 或可采购 SKU。

ChatGPT 定时任务可响应应用事件,Work 浏览器支持登录站点

ChatGPT Release Notes 新增 2026 年 8 月 25 日 日期小节。页面顶部的 Updated 时间不能替代这个日期小节。小节没有精确到小时的发布时间,本期按日期级更新处理。3
第一项是定时任务。ChatGPT Work 中的 scheduled tasks 可用 webhook 响应受支持应用里的变化,当前列出的事件包括新的 Gmail 邮件、Slack 频道消息和 GitHub pull request 活动。Plus 和 Pro 用户可以在网页、iOS 和 Android 上创建这类由事件触发的任务;需要审批的动作会暂停,直到用户确认。Free、Go、Plus 和 Pro 用户可以分享定时任务,接收方会拿到可自定义的独立副本;运行共享的 webhook 任务仍要求对方具备 Work 权限,并连接自己的应用。Free 用户最多可保留 三个 活跃定时任务,且任务最多每天执行一次;Free 和 Go 不能创建 webhook 触发任务。3
第二项是 ChatGPT Work 浏览器。网页和移动端浏览器现在可以在部分需要登录的网站上继续完成任务。用户在登录流程中自行输入凭据或安全码;公告写明 ChatGPT 看不到用户名和密码,模型也不会把它们用于训练,也不会存储这些凭据。用户可随时在 Settings > Cloud browser > Browser data 删除浏览历史。登录能力面向 Plus 和 Pro;涉及预订或付款等后果性操作时,系统会先征求确认。3
Codex 周报把同一批能力写进 August 24–28, 2026 小节,并链接 8 月 25 日发布说明。周报补充了桌面端浏览器扩展面:ChatGPT 桌面应用除 Chrome 外,也可在 Edge、Brave、Opera 或 Vivaldi 中工作;Site tools(WebMCP)让 ChatGPT Work 和 Codex 在桌面内置浏览器里调用网站提供的动作,需要更新桌面应用,并使用 GPT‑5.6 Sol 或 Terra,Luna 以及 Enterprise、Edu 工作区不在支持范围。云端浏览器登录也不面向 Enterprise 或 Edu。可用性仍取决于推送进度和工作区设置。6
产品和管理员团队可以先做三件事:核对工作区是否已开放 Work 与相关插件权限;为需要事件触发的流程接好 Gmail、Slack 或 GitHub,并明确审批节点;在受控账号上试一次登录站点任务,确认凭据只出现在登录框、历史可删除、后果性动作会停在确认点。

数据中心负责人 Chris Malone 离职

CNBC 于北京时间 8 月 26 日 05:23 发布报道,确认 OpenAI 数据中心负责人 Chris Malone 已离开公司。CNBC 写到,Malone 在 2025 年 3 月加入 OpenAI,此前在 Meta 和 Google 从事数据中心基础设施工作;Wall Street Journal 更早报道了这一离职。4
OpenAI 发言人对 CNBC 表示,公司最近重组了基础设施组织,以匹配工作规模与节奏,并称数据中心团队仍有清晰领导和执行计划的技术能力。Yahoo Finance 转载的 Bloomberg 报道补充,发言人在周一确认 Malone 已不在公司;Bloomberg 还援引 Journal 的不具名消息称,OpenAI 在基础设施团队内做了领导调整,并任命了一位负责算力容量的首席技术官,部分数据中心项目由其他人接续推进。后一层属于媒体转述的不具名消息,OpenAI 公开声明只确认了重组与团队仍在执行。47
这条消息落在 Jalapeño 实测同一天窗口内,读者会自然把人事变动和芯片路线放在一起看。公开材料能确认的只有离职与组织重组表态;它没有给出继任者姓名、项目清单变化,或算力资本开支计划的修订。

官方渠道核验:API 与状态页无新日期,Codex 改走周报入口

API Changelog 的最新日期小节仍是 2026 年 8 月 21 日,公开条目停留在按请求选择区域处理和 GPT‑5.6 Sol 价格更新。窗口内没有新的 API 日期小节。8
Status History 的公开记录同样停在 8 月 21 日 的 ChatGPT 网页意外登出事件,之后没有列出 8 月 25 日或 26 日的新事件。这只能说明公开历史页没有新记录,覆盖不了未公开的局部账号或工作区问题。9
Codex 方面,本轮直接访问 codex/changelog 页面仍主要返回文档导航壳,codex/changelog.md 返回 404。可用的替代入口是 Codex What's new:周报已写出 August 24–28 小节,并指向 8 月 25 日 browser 与 event triggers 发布说明。Model Release Notes 的最新日期小节仍停在 8 月 18 日。610

今天需要关注什么

  • 基础设施与成本团队:把 Jalapeño 的模型覆盖、功耗归一化和年底内部部署时间线写进算力评估表,并继续跟踪 NVIDIA 及其他供应商路线;自研硅目前是 OpenAI 自用路线图。12
  • 产品与管理员:检查 Work、定时任务 webhook 和浏览器登录能力是否已对目标套餐与工作区开放,先用 Gmail / Slack / GitHub 做一条可回放的事件触发流程。36
  • 公司观察者:记录 Chris Malone 离职与 OpenAI 关于基础设施重组的公开表态,等待具名继任安排或正式组织说明。4
  • 开发者与运维:API Changelog 与 Status History 本窗口无新日期;继续以日期小节和状态历史页为准做日常核对。89

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel