扩展行为基础模型:迈向通用人形机器人控制

· Editorial Team estimated
人形机器人 行为基础模型 具身智能 全身控制

本文提出扩展行为基础模型(BFM)的系统性框架,通过运动跟踪学习范式、策略-数据协同和Humanoid Transformer架构,在仿真和真实场景中将人形机器人控制精度提升10%至82%。

原文 · arXiv:2607.15163

背景

人形机器人控制需要全身协调、对控制信号的实时响应以及跨环境的鲁棒泛化能力,这使其成为通用具身智能体的核心挑战。行为基础模型(Behavior Foundation Models, BFM)通过大规模行为数据学习,在表达能力、通用性和泛化能力上展现出优势。然而,如何协调学习范式、行为数据和模型架构三大要素以实现有效扩展,仍是一个悬而未决的问题。

核心创新

本研究系统性地给出了BFM扩展的完整配方,包含三个协同组件:

  1. 运动跟踪学习范式:将多样化的人形控制问题重构为全局坐标系下的整体行为再现任务,统一了行走、操作、平衡等多种能力的训练目标。
  2. 策略-数据协同策略:揭示在策略(on-policy) rollout 数量与参考动作多样性之间存在战略协同效应,两者配合提升方可最大化收益。
  3. Humanoid Transformer 架构:一种具有表达能力和可扩展性的新型Transformer架构,能够自然涌现结构化的行为表征,无需显式模块设计。

实验结果

在仿真和真实环境中的广泛实验表明:

  • 局部模式下,测试集平均每关键点位置误差(Mean Per-Keypoint Position Error, MPKPE)降低超过10%
  • 全局模式下,MPKPE 降低82%,相比现有方法取得压倒性优势
  • 控制忠实度和任务泛化能力均显著提升
  • 行为表征自然呈现出结构化、可解释的层次组织

局限性

论文未详细讨论模型在极端环境(如复杂地形、高动态交互)下的表现。Humanoid Transformer 架构的计算开销也未与现有轻量级方法进行对比。此外,真实部署的范围和任务多样性有待进一步扩展。

产业启示

该工作是人形机器人领域迈向通用基础模型的重要里程碑。随着特斯拉Optimus、Figure 01等产品加速落地,具备通用控制能力的基础模型将直接赋能下一代人形机器人产品。Humanoid Transformer 的开源潜力以及扩展策略的可复现性,使其有望成为行业基准框架。