星尘智能
2026-09-04 10:28:38星尘智能发布 SmoothRL 框架,解决机器人实时控制大模型推理延迟问题
星尘智能基座模型团队发布在线强化学习框架 SmoothRL,旨在解决大模型异步推理速度与机器人实时控制需求不匹配的问题。该框架允许强化学习在模型推理结果返回前继续执行,使机器人动作更流畅。团队称,SmoothRL 已在仿真和真实机器人平台验证,能有效减少动作卡顿,提升动态环境下的响应速度和任务成功率。
40

星尘智能基座模型团队发布在线强化学习框架 SmoothRL,旨在解决大模型异步推理速度与机器人实时控制需求不匹配的问题。该框架允许强化学习在模型推理结果返回前继续执行,使机器人动作更流畅。团队称,SmoothRL 已在仿真和真实机器人平台验证,能有效减少动作卡顿,提升动态环境下的响应速度和任务成功率。
