Fast LeWorldModel 这篇机器之心文章,讲的是视觉世界模型规划阶段的一个老问题:候选动作序列要一步步 rollout,慢,而且误差会沿着 imagined trajectory 往后累积。Fast-LeWM 把接口改成 action-prefix prediction,让模型并行预测不同动作前缀对应的未来 latent。1
这组图按 4 张卡拆开看:
- 封面:世界模型为什么慢。
- 旧路:LeWM 逐步 rollout 的计算和误差问题。
- 新路:Fast-LeWM 用动作前缀并行预测未来 latent。
- 结果:平均成功率从 85.8% 到 90.5%,加入 self-consistency 后到 92.0%;动态模块时间从 31.4s 降到 8.0s,完整 CEM 求解时间从 54.4s 降到 28.3s。2




Comments
Sign in to comment.