
8月22日 AI 五条:GPT-5.6 Sol API 再降价,NVIDIA 把 AI 工厂推进到电力与场地
本期聚焦 GPT-5.6 Sol 三个月降价、NVIDIA 布局数据中心基础设施、Starcloud 轨道算力融资、韩国 AI 基金计划与 AVO 智能体评测,标明预算影响、政策状态和公司自测边界。
本期覆盖 2026 年 8 月 21 日 08:30 至 8 月 22 日 08:30(UTC+8)公开或出现状态变化的五条全球 AI 进展,按对调用成本、算力基础设施、合规行动和智能体评估的影响排序。
1. OpenAI 下调 GPT-5.6 Sol API 价格,降价期只有三个月
要点
OpenAI 在 8 月 21 日更新 GPT-5.6 官方页面,宣布 GPT-5.6 Sol 的 API 和额度价格未来 3 个月下调超过 20%。路透社随后报道,标准短上下文用量的输入价格从每百万 token 5 美元降至 4 美元,输出价格从 30 美元降至 20 美元。12
降价适用于 API,也会进入符合条件的 ChatGPT Work 和 Codex 额度。Pro、Plus 和 Business 订阅价格保持不变;此前 GPT-5.6 Terra 和 Luna 的降价属于另一轮调整。2
为何重要
这次变化会直接改写使用 GPT-5.6 Sol 的 API 预算,尤其是输出 token 占比较高的长任务。企业可以按新旧价格重新核算每次任务成本,再用真实工作负载比较 Sol、Terra 和其他模型的质量与延迟。
降价窗口是 3 个月,模型价格表、额度计划和订阅价格也不是同一个范围。准备把调用量迁到 Sol 的团队,应先确认自己的账户是否属于适用计划,并把试用期结束后的价格写进预算,而不是把临时价格当成长期成本。
2. NVIDIA 投资 Cloverleaf,把 AI 工厂的电力和场地也纳入布局
要点
Cloverleaf Infrastructure 8 月 21 日宣布与 NVIDIA 建立战略合作,NVIDIA 已对 Cloverleaf 进行少数股权投资,用于支持 AI 工厂建设。双方没有披露投资金额。Cloverleaf 负责与公用事业公司、能源供应商和投资方推进数据中心选址及基础设施,称自 2024 年成立以来已经交付多个吉瓦级项目。3
NVIDIA 将在合作中提供加速计算、高速网络、基础设施软件和 DSX 平台。Cloverleaf 计划用 DSX 把场地、电力、冷却、计算和设施运营放在同一套设计决策里;路透社称,NVIDIA 的投资金额和财务条款均未公开。4
为何重要
NVIDIA 押注的环节从芯片和服务器延伸到了 AI 数据中心开工前的场地、电力和冷却条件。对建设算力的公司来说,拿到 GPU 只是其中一项约束,能否取得有电力和网络条件的场地同样决定上线时间。
这项合作目前提供的是开发和选址能力,公开信息没有给出新增 GPU 数量、已上线容量或具体客户。读者应把它视为基础设施布局信号,等后续项目披露交付时间、供电规模和实际利用率,再判断它对 AI 算力供给的影响。
3. Starcloud 获 2.5 亿美元融资,轨道数据中心仍停留在扩张路线图
要点
轨道数据中心初创公司 Starcloud 8 月 21 日宣布,在 3 月完成的 1.7 亿美元 A 轮融资基础上追加 2.5 亿美元,公司估值达到 23 亿美元。曼哈顿西部创投领投,NVIDIA 和 Cisco 参与,Benchmark、EQT、Soma 等投资方也参加了本轮扩展。5
Starcloud 将用这笔资金扩大制造设施,并推进最大的轨道数据中心飞船 Starcloud-3。公司已向美国联邦通信委员会申请运营 8.8 万颗航天器,目前更近的计划是 2027 年发射两颗新一代、功率 8 千瓦的 Starcloud-2 计算卫星;面向太空环境设计的 NVIDIA Vera Rubin Space-1 芯片仍未制造,公司希望最早在 2028 年底送入轨道。5
为何重要
这笔融资把 AI 基础设施的竞争带到了轨道数据中心:公司希望用卫星制造和空间计算承接 AI 推理需求,也吸引了 NVIDIA 和 Cisco 这样的产业投资方。
当前披露能确认融资、制造安排和发射计划,仍缺少已部署计算容量、商业服务规模以及轨道供电、散热、通信和维护成本。评估这条路线时,应把融资额、设备工程进展和实际算力交付分开看。
4. 韩国拟设半导体税收基金,AI 投资规模仍未确定
要点
韩国预算部门 8 月 21 日表示,政府计划设立「Future Response Fund」,把半导体繁荣带来的超额税收用于支持年轻人,并投资人工智能、区域发展和人才培养。基金主要由高于过去十年国内税收平均增速基准的税收收入提供资金,政府计划在下月提交 2027 年预算案时,一并向国会提交相关立法。6
韩国政府没有公布基金的官方规模。韩国媒体根据政府对明年税收和其他资金来源的预测,估计规模可能超过 100 万亿韩元,但这一数字仍是媒体估算;目前已公开的内容只确认基金方向、资金来源和后续立法安排。6
为何重要
韩国把 AI 投资放进半导体税收和产业政策的长期安排里,后续预算文件会比新闻稿更能说明资金能否转化为算力、人才和具体项目。对芯片、模型和数据中心企业而言,值得关注的变量是国会提交的法案、基金可支配规模,以及 AI 项目在支出计划中的具体位置。
读者可以先把下月预算案和相关法案列为跟踪节点。100 万亿韩元是媒体估算,不是已批准的 AI 专项预算;韩国政府尚未说明其中有多少资金会直接用于 AI。
5. NVIDIA 的 AVO 研究把智能体成绩从模型分数推向完整系统
5. NVIDIA 的 AVO 研究把智能体成绩从模型分数推向完整系统
要点
NVIDIA 8 月 21 日发布 AVO(Agentic Variation Operators)研究。公司称,在 ARC-AGI-3 公开集的 25 个环境、183 个关卡中,使用 Claude Opus 5 的 AVO 系统取得 100.00 RHAE,完成全部关卡;相同模型在一个没有 AVO 系统的基线中得分为 30%。AVO 还包含持久记忆、工具调用和监督器,用于在长任务中保留进展、观察停滞并调整搜索方向。78
在另一项 GPU 内核优化实验中,AVO 连续运行 7 天,探索超过 500 个方向并提交 40 个内核版本;NVIDIA 称,测试配置下的结果比 cuDNN 快最多 3.5%,比 FlashAttention-4 快最多 10.5%。NVIDIA 同时说明,100 分结果来自公开集,AVO 与 VISTA 使用的模型后端、观察方式、记忆和上下文管理不同,这组比较不能单独拆出 AVO 每个组件的贡献。7
为何重要
这项研究给评估智能体增加了一个实际变量:同一个模型接入不同的记忆、工具、反馈和监督机制,长任务表现可能完全不同。企业测试编码、浏览或自动化工作流时,需要记录完整 harness、上下文管理和工具权限,而不能只抄一个模型排行榜分数。
AVO 的结果来自 NVIDIA 自己的研究和公开基准,覆盖公开集,且公司没有把它表述为已经交付的产品。读者可以把它当作评估方法的信号:先测完整系统在自己的任务、失败恢复和权限边界上的表现,再决定是否更换底层模型。
References
- 1
- 2
- 3
- 4
- 5
- 6
- 7NVIDIA Technical Blog:NVIDIA AVO Reaches 100% on ARC-AGI-3
developer.nvidia.com
- 8
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
- Sign in to comment.
