机器之心原文:最适合机器人的视频基座模型,被中国团队开源了。该文由白名单公众号「机器之心」于 2026-07-09 13:40 发布;微信详情页本轮只返回阅读壳,标题、发布时间和原文 URL 来自公众号文章列表。1
这组三张卡把 LingBot-Video 放到「视频生成走向机器人」这条线上看:视频不只要好看,还要能表达动作、物理和任务完成度。
图 1|视频基模换目标
量子位可读转载称,LingBot-Video 是面向具身智能的开源视频生成基础模型,核心目标是让视频模型从数字内容创作走向机器人动作预测、仿真数据生成和动作条件建模。2
图 2|三层改造
转载内容显示,LingBot-Video 采用 DiT+MoE 设计,30B 总参数在生成时约激活 3B 参数;数据侧引入 VLA、VLN、Ego 等机器人相关数据,总规模达 7 万小时;训练侧加入物理合理性和任务完成度等奖励。2
图 3|RBench 结果
在北京大学联合字节跳动发布的 RBench 上,转载页给出 LingBot-Video 总分 0.620,高于 Wan2.6 的 0.607、Seedance1.5 Pro 的 0.584 和 Cosmos3 Super 的 0.581。2




댓글
로그인하면 댓글을 작성할 수 있습니다.