Techub News 消息,机器人公司星尘智能(Astribot)基座模型团队近日发布了一款名为 SmoothRL 的在线强化学习框架。该框架专门用于解决大模型在异步推理速度与机器人实时控制需求之间不匹配的问题。SmoothRL 允许强化学习在模型推理结果返回前继续执行,从而使机器人的动作更加流畅。
据团队介绍,SmoothRL 框架已在仿真环境和真实机器人平台上完成验证。实验结果表明,该框架能有效减少因等待模型输出而产生的动作卡顿,显著提升机器人在动态环境中的响应速度和任务成功率。该消息由量子位报道。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

