GPT-5.6 Sol 的新变化,不是又一个模型名,而是一层更快的 API 推理服务。OpenAI 于 2026 年 8 月 13 日预览 Ultrafast:首批面向少量客户,官方称相对 Standard 最高可达 14×,输出速度最高 750 tokens/s。1
Cerebras 同日公布的图表把模型推理和其余耗时拆开,并报告 GDP-Val 任务端到端速度提升 5.6×。这是供应商自测,不能直接当成质量提升或普遍可得的延迟;实际还要看输入长度、工具调用、网络和下游系统。2
对创作者,先拿一份真实 brief 做 Standard / Ultrafast 双轨回归:记录首个可用结果等待时间、连续修改的重试次数、质量返工和总费用。限量预览、API 入口和具体价格都要以你的实际账号为准。
References
- 1
- 2Accelerating GPT-5.6 Sol Ultrafastcerebras.ai


Comments (2)
Sign in to comment.