Alpamayo 2 Super、Agent追踪与100亿美元算力协议:AI竞争开始按执行账本结算

Alpamayo 2 Super、Agent追踪与100亿美元算力协议:AI竞争开始按执行账本结算

NVIDIA 的自动驾驶推理模型、Cloudflare 的 Agent 追踪、Volta 的 100 亿美元合同与 SpaceX 的 AI 资本开支共同说明:AI 的下一道门槛是轨迹、容量、回收和责任能否被验收。

今日新模型发布

截至 2026 年 8 月 5 日 21:00(北京时间),本期核验的官方发布面没有出现新的通用基础模型或重大版本更新。最近一个发布周期里,NVIDIA 于 8 月 4 日发布 Alpamayo 2 Super:一个面向自动驾驶开发的 340 亿参数视觉-语言-动作(VLA)推理模型。它不是聊天模型换了名字,而是把未来车辆轨迹、驾驶动作和可检查的因果推理一起作为输出。12
Alpamayo 2 Super 由 320 亿参数的 Cosmos 3 Super Reasoner 和 20 亿参数的扩散式 Action Expert 组成。NVIDIA 文档列出的能力包括生成未来的自车轨迹、输出 Chain-of-Causation(CoC)推理轨迹、自动生成训练标注,并支持让模型先做「让行」「变道」「停车」等高层动作判断,再落到轨迹预测。模型权重位于 NVIDIA 的 Hugging Face 页面,推理 notebook 位于其 GitHub 项目;OpenMDW-1.1 许可允许微调、衍生模型和商业再分发。23
它离「拿来就能跑」仍有距离。NVIDIA 给出的结果包括 6.4 秒轨迹预测的 minADE_6 为 0.911 米、LingoQA 得分 79.2;这些是厂商在指定数据集和基准上的结果。开发者文档同时提示模型对显存敏感,AlpaSim 配置建议最大 batch size 为 1,启用 classifier-free guidance 导航采样时需要两张、每张至少 70 GB 显存。基准成绩说明模型值得测试,不能直接证明道路安全、持续运营或在车端稳定服务。2
NVIDIA 官方配图中的自动驾驶车辆与模型工具链图层
NVIDIA 发布 Alpamayo 2 Super 时使用的官方配图,将车辆、数据、模型和代码放在同一视觉中。1 图片是产品宣传素材,不是道路测试或商业运营证据。

先看总账:五个信号的状态不同

本期覆盖窗口为 2026 年 8 月 5 日 00:00–21:00(北京时间);模型与 Cloudflare 的官方发布发生在 8 月 4 日,作为最近一个发布周期补入。把「已宣布」「已能使用」「已接入生产」分开,今天的信号可以这样读:
信号已确认事实仍未确认的部分
Alpamayo 2 SuperNVIDIA 发布 34B VLA 推理模型,公开权重、许可和开发入口,并提供轨迹、CoC 推理轨迹与自动标注能力。2尚无本期材料证明它已进入大规模商业车队、实际道路运营或持续车端服务。
Cloudflare Agent tracingCloudflare 的 Agents tracing 记录模型调用、工具执行、token、审批事件和子 Agent 调用,并与 Workers 的基础设施追踪关联。4平台有观测能力,不等于客户的 Agent 已经具备稳定成功率、低返工率和可接受的人工接管成本。
Volta 的 100 亿美元合同Volta Infra 自述以 24 亿美元估值完成融资,并获得一份面向欧洲云计算服务的 100 亿美元合同。Reuters 转述 Bloomberg 称买方是 Anthropic、期限六年、项目容量 133 MW,但 Reuters 表示尚未独立核实买方身份。5合同最终交割、资金支付、机房通电、客户验收和容量利用率都没有在本期材料中得到独立确认。
SpaceX 的 AI 资本账Reuters 报道 SpaceX 第二季度资本开支约 184 亿美元,其中 AI 相关支出 158 亿美元;AI 业务收入 26 亿美元但仍经营亏损,CFO 称新算力资本部署的回收期不到一年。6SEC 文件只披露截至 6 月的六个月固定资产、厂房和设备采购 284.76 亿美元,未单列 AI 基础设施支出、AI 分部收入或回收期。7
关键基础设施风险协作Reuters 报道 Jamie Dimon 推动扩展 Alliance for Critical Infrastructure,已向 40 多家公司接触,范围涵盖金融、能源、水务、公用事业、电信、航空和铁路,目标是共享 AI 风险信息并与政府合作。8ACI 是行业协作平台,不是监管许可、模型安全认证,也没有替企业完成系统级风险验收。

1. Alpamayo 把「解释」接到「动作」上

聊天模型的解释通常附着在回答后面,驾驶模型的推理痕迹则要和一条具体轨迹共同通过验收。Alpamayo 2 Super 把 CoC 轨迹、元动作、2D grounding 和未来自车轨迹放进同一开发链,开发团队可以用它生成训练样本、检查模型为什么选择变道,或者把模型输出接进仿真器。2
这里的变化有两层。第一层是分发:权重、许可和 notebook 同时公开,车企或自动驾驶团队可以先做自己的数据和仿真测试。第二层是验收对象发生变化:团队不能只看「答对了多少道题」,还要看轨迹是否满足交通约束、推理轨迹是否与动作一致、异常时能否让出控制权,以及显存和延迟能否适应车端或边缘设备。
NVIDIA 的基准成绩有参考价值,但它们不能替代封闭场地、仿真闭环和道路测试。尤其是模型建议 batch size 为 1、特定采样模式需要两张大显存 GPU,这意味着开放权重只是进入部署链的起点,算力预算和实时性约束仍由使用方承担。2

2. Agent 开始拥有运行时账本

Cloudflare 8 月 4 日公布的 Agent Development Lifecycle(ADLC)把 Agent 当成需要持续测试、部署、观测和退役的软件系统。它列出的工具包括 Agent Traces、Workers Workflows、云端浏览器运行、Vitest、功能开关和渐进式部署;Workflows 可以保存数分钟、数小时甚至数周的状态,自动重试失败任务,并启动其他 Agent 或工作流。9
Cloudflare Agents 的 tracing 更接近企业采购真正需要的账本:每次 model call、tool execution、token、approval event 和 subagent call 都可以进入 trace;Workers tracing 还可以把 fetch、KV、D1、Durable Object 和 service binding 等基础设施调用接上。Cloudflare 明确给出的检查问题是:时间花在模型、工具还是基础设施上,审批在哪里暂停,工具调用是否超时,哪个子 Agent 改变了最终结果。4
这项能力也有一个容易漏掉的成本边界:tracing 在 beta 期间免费,2026 年 10 月 1 日起纳入 Workers Observability 定价;免费层每天包含 20 万个 events、保留 3 天,付费层每月包含 2,000 万个 events,超出部分按每 100 万个 0.60 美元计费、保留 7 天,而且每个 span 都算一个 event。4
对采购方来说,Agent 的「成功率」必须带着完整轨迹来读。没有工具失败、审批等待、重试次数、人工升级、上下文长度和基础设施费用,自动解决率很容易只是演示口径。Cloudflare 给了观察这些变量的产品入口,但没有替客户证明任务质量;验收仍应落到每项任务的成功成本、返工率、暂停恢复和回滚时间。

3. 100 亿美元算力合同,先问客户和容量在哪里

Volta Infra 的消息把算力基础设施的资本故事推到更高金额:公司自述已完成融资,融资后估值 24 亿美元,并拿到一份 100 亿美元、面向欧洲云服务的合同。Reuters 报道同时写明,Bloomberg 以知情人士为来源将买方指向 Anthropic,并称协议为六年期、对应挪威一座 133 MW 的 Bitdeer 数据中心和 NVIDIA Vera Rubin 芯片;Reuters 未能独立核实买方身份,Anthropic 也拒绝置评。5
因此,本期能负责任地写下的是「Volta 宣布了一份 100 亿美元合同」,而不是「Anthropic 已经支付 100 亿美元购买算力」。这不是措辞上的小差别。合同的客户身份、期限、付款方式、取消条款、机房上线时间和实际可用容量,决定它是融资故事、采购承诺,还是已经进入收入确认的基础设施业务。
同一套分层也适用于 133 MW 和未来超过 1 GW 的容量说法:设计容量、预计可用电力、已通电机房、已装机芯片、客户验收和实际利用率是六个不同状态。投资者要追的是最终交割文件、并网和验收记录;采购方要追的是可用容量、服务等级、故障切换和单位成功任务成本。

4. SpaceX 把回收期主张放到会计披露旁边

SpaceX 的最新财报报道提供了一个更尖锐的资本纪律样本。Reuters 称,公司第二季度资本开支约 184 亿美元,其中 AI 相关支出升至 158 亿美元;AI 业务收入为 26 亿美元,同比增幅超过三倍,但仍处于经营亏损状态。CFO Bret Johnsen 表示,新算力资本部署的回收期不到一年,公司在季度末后又签下 67 亿美元云计算合同,并预计年底拥有超过 2 GW 的算力容量。消息发布后,SpaceX 股价盘前下跌约 9%。6
把 SEC 文件放在旁边,口径会更清楚。SpaceX 截至 2026 年 6 月 30 日止六个月购买固定资产、厂房和设备的金额为 284.76 亿美元,另披露了 55.13 亿美元计入应计费用和应付账款、39.21 亿美元由其他融资安排支付;文件没有单列季度 AI 基础设施支出、AI 分部收入或「不到一年回收期」。7
这两组材料并不互相否定,却不能混成一张表。158 亿美元是 Reuters 对公司财报和管理层表述的报道,284.76 亿美元是监管文件中的六个月固定资产采购;前者告诉我们管理层怎样讲 AI 资本回报,后者告诉我们法定披露中实际单列到了哪一层。真正的投资判断还缺利用率、客户集中度、现金回收、能源成本和芯片折旧。

5. AI 风险协作进入关键基础设施

JPMorgan CEO Jamie Dimon 推动的 Alliance for Critical Infrastructure,把 Agent 和模型风险放进了另一张表。Reuters 报道称,ACI 7 月开始接触 40 多家公司,覆盖金融、能源、水务、公用事业、电信、航空和铁路,计划在 8 月继续讨论合作,目标是在年底前全面运作;倡议希望形成对 AI 使用方式和安全防护的共同理解,交换信息,并与美国政府合作识别核心技术风险。8
ACI 官方页面把自己的使命写成跨行业关键基础设施韧性、信息共享、联合响应和基于证据的风险行动。它是协调平台,不是监管批准,也不是对某个模型或 Agent 的安全认证。10
这项协作对企业的实际价值,取决于它能否从倡议变成可交换的事件格式:什么算一次 AI 事故,谁在多久内通知谁,如何隔离被盗凭证和外部工具,哪些日志可以交给同行复盘,谁有权暂停自动化系统。没有这些字段,跨行业联盟只能增加会议;有了这些字段,它才可能影响采购合同和上线门槛。

从业者判断:把验收对象改成任务

企业采购先查四件事:模型是否能在自己的数据和硬件上稳定运行;输出的推理轨迹是否真的对应动作;人工接管、暂停、重试和回滚是否可审计;一次成功任务的 token、工具、等待和人工成本是多少。Alpamayo 的开放许可和 Cloudflare 的 trace 能缩短试验时间,却没有回答这四个问题。
产品团队不要用「能调用工具」替代生产指标。至少要保存完整执行轨迹,统计工具成功率、重试和返工、审批等待、外部 API 超时、上下文成本以及任务完成后的人工修订量。Cloudflare 将 span 纳入计费,也提醒团队:观测本身是运行成本,不是免费的后台装饰。4
投资和基础设施团队把资本状态拆成「宣布合同、签署条款、完成交割、机房通电、客户验收、收入确认」六格。Volta 的 100 亿美元合同、SpaceX 的 2 GW 目标都不能跳过中间格子;当管理层给出「不到一年回收」时,还要把利用率、能源、折旧和现金回款放进同一模型。56
合规和安全团队则要把行业倡议当作协作起点,而不是合规结论。对进入金融、能源、交通和水务的 Agent,验收单里应有最小权限、工具白名单、出站控制、凭证隔离、操作回放、人工升级、事故通知和恢复演练。ACI 的目标是共享风险信息,真正的责任仍落在部署系统的企业和供应商身上。810
本期最值得跟踪的不是哪家公司又公布了一个更大的参数数字,而是这些数字能否穿过执行链:Alpamayo 的轨迹能否在真实约束下稳定运行,Agent 的 trace 能否解释每次失败,算力合同能否变成在线容量,资本投入能否变成现金回收,行业联盟能否变成可执行的事故响应。下一次看到「开放」「100 亿美元」「2 GW」或「不到一年回收」时,先问它处于哪一个状态,再决定它对自己的采购、产品、投资或合规判断意味着什么。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

  • Sign in to comment.
More from this channel