近日,星尘智能团队发布在线强化学习框架SmoothRL,并在真实机器人任务中完成验证。
在线强化学习被认为是解决这一问题的重要方向。不同于传统离线训练,在线强化学习允许机器人通过真实交互获得反馈,并根据成功或失败不断调整策略。SmoothRL的创新点正是在这一矛盾中寻找新的平衡。从测试结果来看,SmoothRL已经展示出这一方向的潜力。实验显示,在线强化学习不仅提高任务成功率,也改善了机器人运动稳定性,使执行过程中的加速度和动作变化更加平滑。不过,在线强化学习距离大规模应用仍有挑战。类似SmoothRL这样的技术探索,正在推动机器人从“部署后固定能力”走向“部署后持续成长”。
