RL-MACRO:面向多模态自适应机器人颅骨切除的控制论闭环智能框架

· Editorial Team estimated
手术机器人 颅骨切除 多模态感知 强化学习 自主手术 控制论

RL-MACRO是一个用于自主机器人颅骨切除的闭环控制论框架,整合了多模态感知(力和声音)、基于离线隐式Q学习(IQL)的自适应决策和机器人执行。CNN-LSTM观测器从部分感知反馈中重建隐藏温度状态(R²=0.939,MAE=1.717°C)。双头Actor动态协调进给速度、主轴转速和切割深度。在牛肋骨和离体山羊头骨上的实验验证了鲁棒的感知能力、对力/温度异常的适应恢复能力以及在不规则表面上的平滑执行。

原文 · arXiv:2607.21113

背景

自主机器人颅骨切除需要持续调节刀具与组织的相互作用,以减轻机械过载和热损伤,同时保持手术效率。然而,由于未知且随时间变化的组织特性以及物理遮挡下无法直接测量切割温度,该过程固有地具有部分可观测性。现有的开环系统无法补偿术中的配准误差或组织变形。

核心创新

RL-MACRO是一个控制论闭环框架,包含三个关键组件。CNN-LSTM观测器融合力和声音反馈,以高精度重建隐藏温度状态(R²=0.939,MAE=1.717°C)。重建温度与多传感器特征一起构成离线隐式Q学习(IQL)策略的置信状态。新颖的双头Actor动态协调进给速度、主轴转速和切割深度,在严格安全边界内优化效率。这些决策通过在线轨迹重规划和速度伺服转化为空间运动。

具体结果

在牛肋骨上的实验显示了鲁棒的突破检测和温度重建能力。在六个离体山羊头骨上,系统展示了对力/温度异常的适应恢复能力和在不规则表面上的平滑执行能力。双头Actor成功平衡了安全约束(热和机械限制)与手术效率。所有实验为安全高效的自主骨切割建立了数据驱动的控制论范式。

局限性

所有实验均在离体生物组织上进行,而非体内环境。该系统尚未在人类尸体或活体手术环境中测试。CNN-LSTM观测器在特定组织类型(牛肋骨、山羊头骨)上训练和评估,向其他骨类型或病理性骨条件的泛化能力尚待证明。IQL策略是离线训练的,在部署过程中可能遇到分布偏移。

行业影响

RL-MACRO代表了向自主机器人手术迈出的重要一步,特别是针对颅骨切除——全球每年进行数万例的手术。通过可靠的闭环控制减少外科医生疲劳和避免硬脑膜损伤具有直接的患者安全意义。多模态感知方法(力+声音用于温度估计)可推广到其他直接感知不可行的手术应用中。开发自主手术系统的医疗机器人公司应密切关注这一研究方向。