GPT-6 Astra 已发布:电脑操作更快,企业入口先收紧

GPT-6 Astra 已发布:电脑操作更快,企业入口先收紧

OpenAI 发布 GPT-6 Astra:电脑操作与专业工作能力跃升,API 价格、订阅入口和安全中断规则同步亮相。

OpenAI 在北京时间 9 月 4 日凌晨宣布 GPT-6 Astra 上线,首批只向一部分组织开放,随后几天扩大到 ChatGPT、API、Azure 和 AWS Bedrock。12
这次公告的产品信号很清楚:OpenAI 把“模型能替用户操作电脑”放在发布中心,同时把速度、判断和安全控制一起绑定到入口上。对采购方来说,当前最值得核对的是三件事:自己的套餐何时拿到 Astra,API 的 每百万 token 10 美元输入、50 美元输出如何对应实际任务成本,以及安全检查会怎样暂停或终止工作。2

一条推文,发生了什么

本期覆盖上一期发布后至北京时间 9 月 4 日 21:00 的 @OpenAI 新增内容。窗口内的核心材料是 9 月 4 日凌晨发布的 GPT-6 Astra 连续公告;9 月 3 日晚上,账号先发布了一段与 Astra 相关的电脑操作视频预热。13
北京时间动作主题X 互动数据
2026 年 9 月 4 日 03:32:13@OpenAI 原创发布 Astra 主帖GPT-6 Astra;电脑操作;“Anything you can do on a computer”约 7429 万次浏览、25.3 万个赞、2.57 万次转发、1.91 万次引用、6123 条回复;数据截至 9 月 4 日 21:07 左右仍会变化。1
2026 年 9 月 4 日 03:32:14@OpenAI 原创链接官方发布页电脑操作、软件工程、网络安全、科学与专业工作约 227 万次浏览;推文列出多个领域的 state of the art 声称。4
2026 年 9 月 4 日 03:32:17@OpenAI 原创公布 rollout有限组织先用,Plus、Pro、Business、Enterprise、API 与 AWS 后续开放约 155 万次浏览;具体开放速度按组织和入口展开。5
Loading content card…

Astra 把电脑操作推到前台

OpenAI 给 Astra 的主叙事不是单项问答成绩,而是让模型完成一整套电脑工作:填写表单、更新 CRM、整理日历、在线检索、修改文档、安装软件和排查屏幕上的问题。官方页面把 Agents’ Last Exam 定义为一组在真实软件中完成复杂职业任务的测试,Astra 得分 59.3%,GPT-5.6 Sol 为 53.6%;在 OSWorld 2.0 离线测试中,Astra 得分 72.6%,Sol 为 65.7%,官方演示中的单项任务耗时约 40 分钟对 75 分钟26
官方页面展示 GPT-5.6 Sol 与 GPT-6 Astra 处理同一项个人网站任务的并排界面
官方对比截图显示,GPT-5.6 Sol 一侧已经生成作品,GPT-6 Astra 一侧仍在执行工具调用并追问会影响结果的职业目标。2
这组数字对使用者有两个直接含义。第一,模型的价值从“回答得更好”扩展到“少盯着电脑等结果”:OpenAI 称 Astra 在 OSWorld 2.0 上以约 47% 更短的时间完成任务。第二,模型会处理指令里的空白:当缺失信息会改变结果时,Astra 会先提出聚焦问题;当问题影响较小,Astra 会按合理假设继续工作。27
评测数字的边界同样重要。官方说明中的成绩取各模型在不同 effort 设置下的最高值,GPT 评测来自研究环境或 API;生产版 ChatGPT 的系统提示词和工具配置可能不同。采购方可以把这些结果当成能力方向和任务样例,随后再用自己的工作流测一次。2

入口扩大,安全门槛也一起上线

Astra 的 rollout 分成几层:首日先给有限组织,随后向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,并进入 OpenAI API、Microsoft Azure 和 AWS Bedrock。订阅额度包含 Astra 的使用,额外用量可以购买 credits;Pro、Business 和 Enterprise 用户还会获得 GPT-6 Astra Pro。Enterprise 管理员需要主动开启 Astra,发布初期工作区默认关闭。25
网络安全是这次发布里最需要区分“能力”和“可用方式”的部分。Astra 在 OpenAI 的网络安全框架中达到 Critical 阈值;在不带生产防护的 ExploitBench 测试中,Astra 得分 100%,GPT-5.6 Sol 为 78.5%。官方页面还给出 ExploitGym 的 42.4% 对 30.3%,并写明专家评测观察到 Astra 能在加固浏览器和操作系统中利用未知漏洞完成攻击链。2
这组网络安全能力暂时对应更窄的产品入口。Astra 上线版本可以做安全代码审查和修复;更高级的漏洞利用概念验证等任务会被拒绝。OpenAI 计划通过 Daybreak 在后续几周扩大访问,并逐步提供更少限制的防御工作流,例如漏洞验证、恶意软件分析和检测工程。2
安全控制也会改变工作流。OpenAI 表示,Astra 的生产监控系统会检查模型推理和行动是否越过授权范围,并自动停止可能未经授权的活动;在 ChatGPT 或 Codex 中,任务暂停后用户可能需要复核才能继续,API 中的任务则会停止。合法的防御工作、长时间运行的智能体和其他正常任务,都可能经历额外中断。2

价格出现了,收入还没有

OpenAI 官方页面列出的 GPT-6 Astra API Standard 价格是:每百万输入 token 10 美元,每百万输出 token 50 美元;缓存读写另计。API 还提供 Fast mode,速度最高可达 Standard 的 2 倍,价格也按 Standard 的 2 倍计算。2
这个价目表把 Astra 的商业选择分成两条。需要更快返回的团队,可以用 Fast mode 换取延迟;更看重预算的团队,则要把任务拆分、缓存命中和输出长度放进总成本。官方页面还在 Terminal-Bench Science 0.1、BenchCAD 等比较中给出估算 API 成本,但这些估算依赖具体配置,不能直接换算成企业账单。2
截至本期,公开材料把价格、入口和管理员开关写得比较具体,把实际调用量、企业启用率、任务中断率和收入变化留给后续披露。高关注度能说明发布吸引了注意力;它还不足以说明用户已经把工作迁移到 Astra。

接下来核验什么

  1. Rollout 的实际速度。 官方只给出“接下来几天”这一时间表。企业管理员是否已经能开启 Astra、不同云平台何时同步上线,决定公告何时变成可采购的服务。2
  2. 单位任务的真实成本。 Standard 与 Fast mode 的价格已经明确,但企业还需要把缓存、输出长度、工具调用和人工复核时间一起计入,才能比较 Astra 与现有模型的总成本。2
  3. 安全摩擦是否可管理。 API 任务停止、ChatGPT 与 Codex 需要复核的设计,会怎样影响长流程自动化、合法防御工作和企业审计,目前要靠实际运行数据回答。2
GPT-6 Astra 这次把能力发布和分发规则放在同一张产品图里:电脑操作更接近可委托的工作,API 价格给出了明确的预算起点,网络安全能力则先以更窄的入口进入市场。下一步真正值得看的,是组织能否拿到访问权限,以及模型在真实任务中节省的时间能否抵消 Fast mode、人工复核和安全中断带来的成本。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel