OpenAI 公布 Jalapeño 首批结果:年底前部署自有机房,Business Premium 席位 100 美元起

OpenAI 公布 Jalapeño 首批结果:年底前部署自有机房,Business Premium 席位 100 美元起

OpenAI 公布自研推理芯片 Jalapeño 首批实测,并称年底前开始部署;同日 Business Premium 席位年付 100 美元可用。本期核对评测数字、绝对价格与仍缺的采用数据。

北京时间 8 月 26 日凌晨,OpenAI 公布自研推理芯片 Jalapeño 的首批实测结果,并称计划在年底前开始部署到自有算力基础设施。1 同日稍晚,@OpenAI 宣布 ChatGPT Business 的 Premium seat 已可用:年付约 100 美元/人/月,月付 125 美元/人/月,用量为 Standard 的 5 倍,且取消五小时用量上限。23 上午,@OpenAI 又转发了 ChatGPT Work 在网页与移动端登录网站、且不读取用户名密码的能力说明。4
这三组动作分别落在算力成本结构、小团队订阅分层和代理登录边界上。公开材料给出了评测倍数、部署时间表和绝对价格;芯片出货量、客户采用率和收入数据仍待后续披露。
Loading content card…

过去一天,OpenAI 发了什么

从上一期发布后到本期发稿前,@OpenAI 时间线新增一组原创芯片线程、一条 Business 定价推文,以及一条产品能力转发。发布时间均换算为北京时间。
北京时间动作媒体X 详情页可见互动
8 月 26 日 01:19:29公布 Jalapeño 首批实测:更高吞吐、更低延迟视频12,260 个赞、973 次转发、478 次引用、519 条回复、约 186.9 万次浏览。5
8 月 26 日 01:19:30说明对 ChatGPT、Codex 与 agent 响应速度的含义图片1,140 个赞、25 次转发、25 次引用、16 条回复、约 12.8 万次浏览。6
8 月 26 日 01:19:30称年底前开始在自有机房部署,并指向官方结果页卡片958 个赞、22 次转发、9 次引用、20 条回复、约 10.0 万次浏览。7
8 月 26 日 03:36:25宣布 ChatGPT Business Premium Seats,标出 100 美元档视频3,725 个赞、222 次转发、143 次引用、241 条回复、约 158.5 万次浏览。2
8 月 26 日 09:07:55转发 @ChatGPT:Work 可用电脑与浏览器登录网站,且不看见账号密码无媒体原帖约 1.20 万赞、940 次转发、约 228.1 万次浏览。4
芯片主帖与 Premium 推文的浏览量都超过百万级。这组互动数据反映的是 X 上的关注热度;真实部署规模、席位销量和收入变化仍要看后续经营披露。

Jalapeño:首批数字出来了,机房部署还在年底

OpenAI 把 Jalapeño 写成公司第一颗自研推理芯片,并在官方结果页给出对照评测。评测平台是 SemiAnalysis 的公开基准 InferenceX,对照对象是 leading commercially available AI systems。1
在 GPT‑OSS 120B、DeepSeek R1 与 Kimi K2.5 1T 三组公开模型上,OpenAI 给出的汇总区间是:峰值吞吐下每瓦 AI 工作量约为对照系统的 1.5–1.9 倍,端到端延迟约为对照的 1.7–3.6 倍更低;高交互负载下性能约为 2.1–4.1 倍1 芯片标称封装功耗 700 瓦,官方称实测持续功耗在测试负载上不超过 550 瓦1
安装在青绿色电路板上的 Jalapeño 推理芯片特写
OpenAI 官方结果页发布的 Jalapeño 芯片实物照片,拍摄于青绿色电路板之上。1
附录里还给出了更细的点位。以 GPT‑OSS 120B 为例,峰值混合吞吐/千瓦约为 85,448 vs 44,960(约 1.9 倍),端到端延迟约为 1.03 秒 vs 1.80 秒;对照系统封装 TDP 写为 GB200 的 1,200 瓦。1 DeepSeek R1 与 Kimi K2.5 的对照封装 TDP 写为 GB300 的 1,400 瓦。1
这些数字属于公司自有对照结果,口径是按封装 TDP 归一后的每瓦表现。对采购方,它们更适合回答 OpenAI 内部服务成本与延迟可能怎样变化;客户能否直接买到这颗芯片,公开材料尚未说明。
部署时间表写得很明确:OpenAI 计划在 年底前 开始把 Jalapeño 部署进自有算力基础设施;它是多代路线图的第一代,Gen 2 已深入开发,Gen 3 正在成形。17 官方同时写明,训练与推理仍会继续广泛使用 NVIDIA 及其他合作伙伴加速器。1
商业叙事落在服务成本结构。结果页写到,更高效率可以让有用工作与收入增长快于服务成本,从而改善经营杠杆;也可支持更广采用与后续模型、产品和基础设施投入。1 这是公司对内部经济性的方向性表述。公开材料暂未列出芯片数量、良率、资本开支、单位推理成本下降幅度,也暂未说明 ChatGPT 或 API 价格会否因此调整。

Premium seat:小团队订阅正式拆成两档

Premium seat 的产品页最初发布于 8 月 10 日;页面顶部的 8 月 25 日更新写明,Premium seats 现已在 ChatGPT Business 上可用,早期 workspace credits 促销已经结束。3 @OpenAI 在北京时间 8 月 26 日 03:36 用推文对外强调了 100 美元 这一年付标价。2
席位年付(按月折算)月付公开用量边界
Standard seat20 美元/人/月25 美元/人/月日常工作基线。38
Premium seat100 美元/人/月125 美元/人/月用量为 Standard 的 5 倍,取消五小时用量上限,按周重置。38
同一 workspace 可以混用 Standard 与 Premium,管理员可为不同成员分配或改派席位。3 Business 定价页还写明,计划面向约 2–200 人团队,并包含 ChatGPT、ChatGPT Work 与 Codex 功能,以及 SAML、SSO、MFA 等管理能力。8 超出 included 限额后,仍可通过 workspace credits 加购。3
对采购方,可立即核对的是绝对价格和席位混用规则。年付 Premium 是 Standard 的 5 倍价,对应公开宣传的 5 倍用量与取消五小时上限。是否划算,取决于团队里有多少人会撞到 Standard 限额,以及 credits 超额计费是否更便宜。这些页面暂未给出 Standard 与 Premium 的绝对 token 配额、席位销量或升级转化率。
Loading content card…

Work 登录:官方转发把能力边界说清楚了

北京时间 8 月 26 日上午,@OpenAI 转发 @ChatGPT 的说明:ChatGPT Work 现在可以在网页与移动端用自己的电脑和浏览器登录网站,且 ChatGPT 不会看到用户名或密码。4 原帖列举了从预约、报销到发票入账等任务示例;套餐名单、地区范围、成功率和客户采用数据仍待补充。
这条转发适合当作产品定位信号:OpenAI 在强化“代理可以替用户完成需登录任务,同时把凭证与模型可见范围分开”的说法。价格、正式可用范围和真实完成率,仍要等后续产品页或经营披露。

接下来要核验的三个问题

  1. Jalapeño 何时真正服务在线流量。 OpenAI 是否会披露年底部署的机房规模、承载的模型与产品、单位推理成本变化,以及 ChatGPT / API 延迟是否出现可测改善?这些数据才能把评测倍数翻译成服务成本或用户体验。
  2. Premium seat 卖给了谁、卖了多少。 后续是否会出现席位销量、Standard 升 Premium 比例、credits 消耗,或中小团队 ARPU 变化?在这些数据出现前,100 美元档仍主要是价目表更新。
  3. Work 登录任务的真实边界。 OpenAI 是否会公布支持地区、套餐资格、网站兼容名单,以及需要用户接管的失败比例?这些细节决定代理登录是演示能力,还是可规模化的工作流入口。
本期最重要的变化,是 OpenAI 同时把自研推理芯片的实测结果和企业席位的绝对价格放到台面上。芯片端给出了年底部署时间表,订阅端给出了可立刻采购的两档价目;采用规模、服务成本下降和收入影响,仍要等后续经营数据。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel