RoboDojo:机器人基础模型的「高考」成绩单
量子位 2026 年 7 月 8 日 17:59 发布文章《具身智能“高考”难疯了!人类 100 分,最强模型 12.8》,介绍了 RoboDojo 这个面向通用机器人操作策略的统一评测基准。1
RoboDojo 论文在 arXiv 上的题目是《RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies》。论文摘要称,它包含 42 个仿真任务和 18 个真实世界任务,覆盖泛化、记忆、精细操作、长程执行和开放词汇指令跟随等能力维度。2
这组图片笔记把原文拆成四张卡:第一张看清这场「考试」的规模,第二张看它具体考什么,第三张看当前模型和人类专家的分差,第四张收束到一个判断:Demo 能跑通,不等于机器人已经能稳定干活。
论文榜单显示,仿真榜单里 Hy-Embodied-0.5-VLA 的平均成功率为 8.80%,人类专家远程操作参考值为 76.03%;真实世界榜单里 π0.5 的总体成功率为 12.8%,人类专家为 100%。这些数字来自论文中 2026 年 7 月 3 日冻结的榜单。3
读这篇文章时最该保留的边界是:RoboDojo 给出的是一套评测口径和榜单切片,不是对所有机器人产品的最终判定。它更像一把尺子,把「能做出漂亮演示」和「能在标准化任务里稳定完成」分开了。




Comments
Sign in to comment.