Diffusion ReRoll:面向机器人序列预测的可修正去噪方法
Diffusion ReRoll提出结构化重噪声方法,使预测序列中的早段和晚段能够相互修正。在OGBench上,它比Diffusion Forcing的引导规划成功率相对提高21%;在LIBERO-10上,比Diffusion Policy的动作预测相对改进56.5%;在统一视频-动作预测中取得了最佳的动作-视频一致性。
原文 · arXiv:2607.19919背景
现有的基于扩散模型的序列预测器通常执行单一单调去噪过程——一旦预测的某个区域变得局部稳定,就无法利用序列其他部分的信息进行修正。这种刚性问题限制了长周期预测的质量,因为早段和晚段无法相互提供信息。
核心创新
Diffusion ReRoll选择性地对扩散轨迹中已变得局部稳定的区域重新注入噪声,而其余区域继续去噪,从而利用整个预测周期的上下文信息对重噪声区域进行再次精化。这种结构化重噪声机制实现了迭代式跨周期修正,让早段和晚段能够相互改进,同时保持局部一致性。核心洞见在于,最优的序列预测需要双向信息流动,而单调去噪无法提供这一能力。
具体结果
在OGBench的PointMaze和AntMaze任务中,Diffusion ReRoll在基于引导的规划上比Diffusion Forcing的平均成功率相对提高21%,比Diffuser的目标补全规划相对提高23%。在扩散策略风格的动作预测中,它在LIBERO-10多任务基准上跨不同预测周期和历史长度取得了比Diffusion Policy相对提高56.5%的平均成功率。在统一视频-动作预测中,Diffusion ReRoll提升了策略和逆动力学性能,尤其在分布外评估场景下表现突出,并取得了最佳的动作-视频一致性。
局限性
结构化重噪声机制比单调去噪增加了计算开销。方法的有效性依赖于重噪声调度和区域选择策略的质量,可能需要针对不同领域进行调整。长周期性能提升虽然在仿真中显著,但在实际部署中面对噪声观测时可能面临额外挑战。
行业影响
Diffusion ReRoll推进了机器人序列生成的前沿——这是规划、策略学习和视频-动作建模的核心能力。通过实现预测的双向修正,它生成了更高质量的长周期计划和更一致的视频-动作轨迹。这对自主导航、长周期任务规划和基于视频的策略学习等关键应用领域具有直接意义,所有这些对于在复杂真实环境中部署机器人至关重要。