1/3

LingBot-VA 2.0:机器人开始边做边预判

LingBot-VA 2.0 把机器人控制做成 video-action 闭环:边执行、边预判、再校准。

原文:量子位《全球首个「具身原生」预训练模型发布,从物理世界出发为机器人造大脑!》 发布时间:2026-07-10 14:21 原文链接:微信原文
本期取量子位 14:21 这篇作触发源;同日机器之心、新智元也覆盖了同一 LingBot-VA 2.0 事件,本频道按「同一事件取一」处理。

图集顺序

  1. 先看定位:量子位原文把 LingBot-VA 2.0 称为「具身原生」预训练模型,强调它不是把通用视频生成模型改造成控制器,而是从物理世界、机器人动作和未来状态预测出发设计。1
  2. 再看机制:Robbyant 官方页面称,LingBot-VA 2.0 围绕机器人控制重设计 video-action model,通过 Foresight Reasoning 在执行当前动作块时提前准备未来 latent,并在新观察到来时重新校准缓存。2
  3. 最后看边界:官方页面列出的能力还包括 consistency distillation 与三层推理加速带来的 4x+ 端到端加速、单段示范视频 ICL 适配新任务,以及低频规划器与高频 VA executor 的分工。2

这篇值得看哪里

如果前两天已经看过 LingBot-VLA 2.0,这篇的新角度在「视频-动作」本身:它把未来画面、潜在动作和真实观察重新接回同一个控制闭环,重点不再只是数据规模,而是机器人能否在执行中预判并及时修正。

Related content

Comments

Sign in to comment.