DriftWorld:漂移生成模型驱动的快速世界建模
· Editorial Team estimated
世界模型 漂移生成模型 机器人规划 策略评估
DriftWorld利用漂移生成模型替代扩散模型,实现30+ FPS的单步世界模型推理,速度提升17倍,并在多个机器人操作基准上取得最先进决策性能。
原文 · arXiv:2607.15065背景
预测性世界模型使机器人能够通过想象动作结果来进行规划,但扩散模型的多步采样使得每次 rollout 成本高昂,限制了推理时的动作搜索规模。这一问题成为扩散世界模型在机器人控制中实用化的核心瓶颈。
核心创新
DriftWorld 提出**漂移生成模型(drifting generative model)**作为扩散模型的替代方案:
- 训练阶段:学习动作条件化的漂移过程,而非学习去噪过程
- 推理阶段:仅需一次前向传播即可从当前观测和候选动作序列生成未来帧,无需迭代采样
- 推理速度达到 30+ FPS,比扩散基线平均快17倍
实验结果
在多种视觉机器人操作基准上进行评估:
| 基准 | 结果 |
|---|---|
| Bridge-V2, RT-1, Language Table, Push-T, Robomimic | 达到最先进的决策性能 |
| 推理速度 | 30+ FPS(17×加速于扩散基线) |
| 策略排名相关性 | 与真实轨迹相关性高达 0.99 |
关键发现:DriftWorld 不仅能用于在线控制,还可作为离线模拟器对真实机器人策略进行排序评估,其 rollout 分数与真实性能高度一致(相关系数 0.99)。
局限性
漂移生成模型在高度多模态的未来分布(如多个同样合理的动作结果)下的表现尚未充分探索。论文主要评估了操作任务,在高动态运动规划等场景中的适用性有待验证。模型对不同仿真环境的泛化能力也需要进一步研究。
产业启示
DriftWorld 显著降低了世界模型在机器人系统中的推理成本,使得实时想象-规划成为可行。这对于需要实时决策的自主机器人(如仓储、服务、制造)具有直接的应用价值。作为离线策略评估工具,它还能帮助机器人团队在部署前筛选最佳策略,减少昂贵的人工测试成本。