GPT-5.6 Sol 跟进:AWS Bedrock 上线,5 小时限制临时取消

GPT-5.6 Sol 跟进:AWS Bedrock 上线,5 小时限制临时取消

GPT-5.6 Sol 新增 Amazon Bedrock 接入路径,Bedrock 模型卡确认 272K 上下文和 bedrock-mantle endpoint;OpenAI 也临时移除了 Plus、Business、Pro 的 5 小时使用窗口。本文梳理企业接入、价格、限额和开发者该怎么测试。

GPT-5.6 Sol 的跟进点很明确:它不只是 OpenAI 第一方 API 和 ChatGPT 里的旗舰模型了,现在也进了 Amazon Bedrock;同时,OpenAI 临时拿掉了 Plus、Business、Pro 计划上最容易卡住长任务的 5 小时使用窗口。前者影响企业接入路径,后者影响开发者能不能连续跑 Codex 和 ChatGPT Work。1 2

先看结论

如果你已经在 AWS 上跑 Bedrock,GPT-5.6 Sol 现在有了更方便的企业采购和权限管理路径,但接入方式不是旧的 bedrock-runtime,而是 bedrock-mantle 上的 openai/v1/responses 路径。AWS 模型卡给出的上下文窗口是 272K tokens,模型 ID 是 openai.gpt-5.6-sol3
如果你主要用 ChatGPT Work 或 Codex,这次更像一次可用性补丁。Tibo 说 OpenAI 临时移除 Plus、Business、Pro 的 5 小时使用限制,并在同一条更新里提到 GPT-5.6 Sol 会变得更省用量、所有用户会获得一次用量重置。它不是永久改价,也不是无限使用;更稳妥的理解是,短周期限额暂时放松,周额度仍要看账户里的实时显示。2 4
콘텐츠 카드를 불러오는 중…

关键信息

维度信息
更新性质同一模型的可用性跟进:AWS Bedrock GA,加上 ChatGPT Work / Codex 侧的临时限额放松。1 2
Bedrock 发布时间AWS 在 2026 年 7 月 13 日宣布 GPT-5.6 Sol、Terra、Luna 在 Amazon Bedrock 一般可用。1
Bedrock 上下文GPT-5.6 Sol 的 Bedrock 模型卡写明上下文窗口为 272K tokens。3
Bedrock 接入模型 ID 是 openai.gpt-5.6-sol,走 https://bedrock-mantle.{region}.api.aws/openai/v1,支持 Responses API,不支持 bedrock-runtime、Chat Completions、Invoke 或 Converse。3
区域Sol 支持 US East (N. Virginia) 和 US East (Ohio);Terra、Luna 还支持 US West (Oregon)。1
价格AWS 称 Bedrock 价格匹配 OpenAI 第一方费率;OpenAI 发布页给出的 Sol API 价格是每 100 万输入 token 5 美元、输出 token 30 美元。1 5
参数规模官方仍未披露参数规模。OpenAI 发布页和 AWS 模型卡都只披露能力、价格、接口和可用范围,没有给出参数量。3 5
Benchmark 新增这次 Bedrock 上线没有给出新的 benchmark。仍可参考 OpenAI 首发披露:Agents’ Last Exam 53.6,Artificial Analysis Coding Agent Index 80,BrowseComp 92.2%。5

Bedrock 这条线,重点不是「又多一个入口」

真正的变化在企业采购和部署边界。AWS 写得很直接:GPT-5.6 通过 Amazon Bedrock 的下一代推理引擎提供,使用量可以计入 AWS commitments;对很多公司来说,这比单独开 OpenAI 账单更容易落进既有采购、权限、审计和区域治理流程。1
但接入方式需要特别看清。AWS 模型卡明确写了 bedrock-mantle,并提示这个模型在 openai/v1/responses 路径上可用,和其它模型常见的 responses endpoint 路径不同。换句话说,如果你的现有 Bedrock 封装只会走 bedrock-runtime 或 Converse,这次不能直接把模型名替换进去就完事。3
上下文窗口也要按 Bedrock 口径读。AWS 模型卡给 Sol 写的是 272K tokens,不应把 OpenAI 第一方环境里的上下文宣传自动套到 Bedrock 上。做长仓库、长文档、长链路 agent 测试时,先按 272K 预算设计切分和缓存策略。3

5 小时限制取消,影响的是连续工作流

这次限额变化最直接影响的是 Codex 和 ChatGPT Work 的长任务。Tibo 的原话是,过去 48 小时 Codex 和 ChatGPT Work 的使用很激烈,所以 OpenAI 临时移除 Plus、Business、Pro 的 5 小时使用限制,同时让 GPT-5.6 Sol 更省用量,并给用户落一次 usage reset。2
BleepingComputer 的报道补了一点产品层面的解释:Codex 和 ChatGPT 会把本地消息与云端任务计入同一个使用池;5 小时窗口拿掉后,用户不再因为短窗口耗尽而中断,但这不等于 GPT-5.6 Sol 变成无限使用,周额度仍可能生效。4
OpenAI 帮助中心当前仍把 GPT-5.6 描述为使用既有 ChatGPT 限额体系,且具体限制会随计划、工作区设置和系统条件变化。把这几条合起来看,最可靠的做法不是按「无限」规划,而是按「短窗口暂时不挡路,周额度仍是硬边界」规划。6

读者该怎么做

如果你在 AWS 里评估 GPT-5.6 Sol,第一步不是跑 benchmark,而是先打通 bedrock-mantle。确认区域、模型 ID、Responses API 路径、鉴权方式和日志链路都能跑,再把真实任务迁过去测。尤其是已有 Converse / Invoke 封装的团队,要预留一层适配。3
如果你在 ChatGPT Work 或 Codex 里做长时间 coding agent,今天可以更积极地试 Sol,但不要把临时窗口当成长期合同。账户里的 usage 面板仍是准绳;高成本的 ultra、多 agent 和长上下文任务,最好继续分阶段保存结果,避免一次任务把周额度烧穿。2 4
如果你在比较 OpenAI 第一方 API 和 Bedrock,核心差异不是单价。AWS 说价格匹配第一方费率,还支持 prompt caching,重复上下文在 agent workflow 中可按 90% 折扣计费;Bedrock 的价值更多在采购归集、AWS commitment、区域和治理,而不是单纯便宜。1
这次跟进给 Sol 补上了两块拼图:企业侧多了 Bedrock 路径,个人和团队侧少了一个短窗口限制。下一步要盯的不是跑分,而是 OpenAI 会不会把这次「临时」限额调整固化下来,以及 AWS 会不会继续补齐更多区域、服务层级和更完整的 Bedrock 原生接口支持。

관련 콘텐츠

  • 로그인하면 댓글을 작성할 수 있습니다.
More from this channel