
GPT-6 Astra 已发布:电脑操作更快,企业入口先收紧
OpenAI 发布 GPT-6 Astra:电脑操作与专业工作能力跃升,API 价格、订阅入口和安全中断规则同步亮相。
这次公告的产品信号很清楚:OpenAI 把“模型能替用户操作电脑”放在发布中心,同时把速度、判断和安全控制一起绑定到入口上。对采购方来说,当前最值得核对的是三件事:自己的套餐何时拿到 Astra,API 的 每百万 token 10 美元输入、50 美元输出如何对应实际任务成本,以及安全检查会怎样暂停或终止工作。2
一条推文,发生了什么
本期覆盖上一期发布后至北京时间 9 月 4 日 21:00 的 @OpenAI 新增内容。窗口内的核心材料是 9 月 4 日凌晨发布的 GPT-6 Astra 连续公告;9 月 3 日晚上,账号先发布了一段与 Astra 相关的电脑操作视频预热。13
| 北京时间 | 动作 | 主题 | X 互动数据 |
|---|---|---|---|
| 2026 年 9 月 4 日 03:32:13 | @OpenAI 原创发布 Astra 主帖 | GPT-6 Astra;电脑操作;“Anything you can do on a computer” | 约 7429 万次浏览、25.3 万个赞、2.57 万次转发、1.91 万次引用、6123 条回复;数据截至 9 月 4 日 21:07 左右仍会变化。1 |
| 2026 年 9 月 4 日 03:32:14 | @OpenAI 原创链接官方发布页 | 电脑操作、软件工程、网络安全、科学与专业工作 | 约 227 万次浏览;推文列出多个领域的 state of the art 声称。4 |
| 2026 年 9 月 4 日 03:32:17 | @OpenAI 原创公布 rollout | 有限组织先用,Plus、Pro、Business、Enterprise、API 与 AWS 后续开放 | 约 155 万次浏览;具体开放速度按组织和入口展开。5 |
Loading content card…
Astra 把电脑操作推到前台
OpenAI 给 Astra 的主叙事不是单项问答成绩,而是让模型完成一整套电脑工作:填写表单、更新 CRM、整理日历、在线检索、修改文档、安装软件和排查屏幕上的问题。官方页面把 Agents’ Last Exam 定义为一组在真实软件中完成复杂职业任务的测试,Astra 得分 59.3%,GPT-5.6 Sol 为 53.6%;在 OSWorld 2.0 离线测试中,Astra 得分 72.6%,Sol 为 65.7%,官方演示中的单项任务耗时约 40 分钟对 75 分钟。26

这组数字对使用者有两个直接含义。第一,模型的价值从“回答得更好”扩展到“少盯着电脑等结果”:OpenAI 称 Astra 在 OSWorld 2.0 上以约 47% 更短的时间完成任务。第二,模型会处理指令里的空白:当缺失信息会改变结果时,Astra 会先提出聚焦问题;当问题影响较小,Astra 会按合理假设继续工作。27
评测数字的边界同样重要。官方说明中的成绩取各模型在不同 effort 设置下的最高值,GPT 评测来自研究环境或 API;生产版 ChatGPT 的系统提示词和工具配置可能不同。采购方可以把这些结果当成能力方向和任务样例,随后再用自己的工作流测一次。2
入口扩大,安全门槛也一起上线
Astra 的 rollout 分成几层:首日先给有限组织,随后向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,并进入 OpenAI API、Microsoft Azure 和 AWS Bedrock。订阅额度包含 Astra 的使用,额外用量可以购买 credits;Pro、Business 和 Enterprise 用户还会获得 GPT-6 Astra Pro。Enterprise 管理员需要主动开启 Astra,发布初期工作区默认关闭。25
网络安全是这次发布里最需要区分“能力”和“可用方式”的部分。Astra 在 OpenAI 的网络安全框架中达到 Critical 阈值;在不带生产防护的 ExploitBench 测试中,Astra 得分 100%,GPT-5.6 Sol 为 78.5%。官方页面还给出 ExploitGym 的 42.4% 对 30.3%,并写明专家评测观察到 Astra 能在加固浏览器和操作系统中利用未知漏洞完成攻击链。2
这组网络安全能力暂时对应更窄的产品入口。Astra 上线版本可以做安全代码审查和修复;更高级的漏洞利用概念验证等任务会被拒绝。OpenAI 计划通过 Daybreak 在后续几周扩大访问,并逐步提供更少限制的防御工作流,例如漏洞验证、恶意软件分析和检测工程。2
安全控制也会改变工作流。OpenAI 表示,Astra 的生产监控系统会检查模型推理和行动是否越过授权范围,并自动停止可能未经授权的活动;在 ChatGPT 或 Codex 中,任务暂停后用户可能需要复核才能继续,API 中的任务则会停止。合法的防御工作、长时间运行的智能体和其他正常任务,都可能经历额外中断。2
价格出现了,收入还没有
OpenAI 官方页面列出的 GPT-6 Astra API Standard 价格是:每百万输入 token 10 美元,每百万输出 token 50 美元;缓存读写另计。API 还提供 Fast mode,速度最高可达 Standard 的 2 倍,价格也按 Standard 的 2 倍计算。2
这个价目表把 Astra 的商业选择分成两条。需要更快返回的团队,可以用 Fast mode 换取延迟;更看重预算的团队,则要把任务拆分、缓存命中和输出长度放进总成本。官方页面还在 Terminal-Bench Science 0.1、BenchCAD 等比较中给出估算 API 成本,但这些估算依赖具体配置,不能直接换算成企业账单。2
截至本期,公开材料把价格、入口和管理员开关写得比较具体,把实际调用量、企业启用率、任务中断率和收入变化留给后续披露。高关注度能说明发布吸引了注意力;它还不足以说明用户已经把工作迁移到 Astra。
接下来核验什么
- Rollout 的实际速度。 官方只给出“接下来几天”这一时间表。企业管理员是否已经能开启 Astra、不同云平台何时同步上线,决定公告何时变成可采购的服务。2
- 单位任务的真实成本。 Standard 与 Fast mode 的价格已经明确,但企业还需要把缓存、输出长度、工具调用和人工复核时间一起计入,才能比较 Astra 与现有模型的总成本。2
- 安全摩擦是否可管理。 API 任务停止、ChatGPT 与 Codex 需要复核的设计,会怎样影响长流程自动化、合法防御工作和企业审计,目前要靠实际运行数据回答。2
GPT-6 Astra 这次把能力发布和分发规则放在同一张产品图里:电脑操作更接近可委托的工作,API 价格给出了明确的预算起点,网络安全能力则先以更窄的入口进入市场。下一步真正值得看的,是组织能否拿到访问权限,以及模型在真实任务中节省的时间能否抵消 Fast mode、人工复核和安全中断带来的成本。
References
- 1
- 2
- 3OpenAI 官方 X 原帖(视频预热)
x.com
- 4OpenAI 官方 X 原帖(发布页)
x.com
- 5OpenAI 官方 X 原帖(可用范围)
x.com
- 6
- 7
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
More from this channel›
- OpenAI 连推三项企业级动作:金融专属版、数据智能体与实时语音 API
- OpenAI 披露“防御工厂”实操数据,RLHF 奠基人入局基金会董事会
- OpenAI 称解出千禧数学难题并回应数据争议,Astra 现已全量开放
- Astra 先向高阶用户开放,OpenAI 为“wiki 事件”准备新的披露规则
- Astra 达到 Critical 阈值:OpenAI 把高端网络能力放进更窄的入口
- SpaceX 收购 Cursor 后,OpenAI 提议 11 月 12 日终止模型直连
- OpenAI 呼吁全球网络防御协作:从模型访问到关键基础设施支持
- OpenAI 公布 Hugging Face 事件技术报告:评测越界路径与 30 分钟停机规则
