让机器人学会选择输出快!慢!动作
论文:HiPolicy,arXiv: 2604.06067。 这篇论文最吸引我的地方,是它把机器人动作输出拆成了“快动作”和“慢动作”:不是让模型永远用同一个频率生成动作,而是根据任务状态,自适应选择更合适的动作频率。 核心问题:为什么单一频率不够? 主流模仿学习方法,比如 DP、ACT、DP3,通常采用固定频率的动作 …
论文:HiPolicy,arXiv: 2604.06067。 这篇论文最吸引我的地方,是它把机器人动作输出拆成了“快动作”和“慢动作”:不是让模型永远用同一个频率生成动作,而是根据任务状态,自适应选择更合适的动作频率。 核心问题:为什么单一频率不够? 主流模仿学习方法,比如 DP、ACT、DP3,通常采用固定频率的动作 …