星尘智能发布 SmoothRL 框架,解决机器人实时控制大模型推理延迟问题
星尘智能基座模型团队发布在线强化学习框架 SmoothRL,旨在解决大模型异步推理速度与机器人实时控制需求不匹配的问题。该框架允许强化学习在模型推理结果返回前继续执行,使机器人动作更流畅。团队称,SmoothRL 已在仿真和真实机器人平台验证,能有效减少动作卡顿,提升动态环境下的响应速度和任务成功率。

星尘智能基座模型团队发布在线强化学习框架 SmoothRL,旨在解决大模型异步推理速度与机器人实时控制需求不匹配的问题。该框架允许强化学习在模型推理结果返回前继续执行,使机器人动作更流畅。团队称,SmoothRL 已在仿真和真实机器人平台验证,能有效减少动作卡顿,提升动态环境下的响应速度和任务成功率。

第二届世界人形机器人运动会上,智元获得18枚金牌、46枚奖牌,位列金牌榜和奖牌榜第一。赛事新增21个场景赛项,覆盖应急救援、酒店服务、图书管理和家庭生活,比赛重心从动作展示延伸到任务完成。与此同时,智元又在横琴长隆推进合作项目,双方将覆盖四个全球性项目并计划共建联合实验室。文章认为,具身智能行业的竞争,正在从单一技术展示转向技术能力与商业交付的双重比拼。

谷歌云AI研究团队联合华盛顿大学、北卡罗来纳大学教堂山分校发布EnvHarness,一个可将静态智能体基准环境转为动态训练环境的可编程层。该工具通过标准接口包装现有环境,自动调整任务起点、可用动作与观察内容。EnvHarness包含Stage、Contract和Chain三个组件,配套EnvRigger可自动诊断策略缺陷。在四个领域的五个基准测试中,智能体在未见任务上性能提升最高达9.0分,执行步骤减少9.8%。工具以Apache-2.0许可证的Python库发布,要求环境可重置。

智元在第二届世界人形机器人运动会拿下18枚金牌、46枚奖牌,位列金牌榜和奖牌榜第一。赛事新增21个场景赛项,覆盖应急救援、酒店服务、图书管理、家庭生活四大领域,智元获得其中6枚金牌。8月22日晚,24台远征A3在北京冰丝带与20名专业舞者同台演出,并与丁宁完成人机对打;次日,智元又在长隆落地合作,双方将推进4个全球性文旅项目及联合实验室建设。文章认为,人形机器人竞争正从单点技术或单一商业化,转向技术能力、交付体系与场景运营并行的系统能力比拼。

清华大学自动化系赵明国教授团队联合字节跳动 Seed、中国农业大学,在《Science Robotics》发表论文《Learning Vision-Driven Reactive Soccer Skills for Humanoid Robots》。论文提出视觉驱动的反应式足球技能学习框架,并在加速进化的人形机器人平台上完成真机验证,覆盖找球、追球、调整步态和多方向射门。

上海发布软件和信息服务业“十五五”规划,提出到 2030 年产业规模力争达到 4 万亿元、产业增加值突破 1.1 万亿元,并围绕人工智能、新兴赛道和开源生态提出 18 项任务。同日,多家企业披露新动态,包括腾讯微信灰测 AI 帮写与 AI 点评、SK 海力士重启大连 NAND 二厂建设、英特尔将普通股公开发行规模扩大至 200 亿美元。监管、资本市场和产业数据方面,也出现 CCC 证书撤销、ETF 规模逼近 5 万亿元等新进展。

Meta证实收购机器人初创ARI,交易金额未披露。ARI团队将整体并入Meta的Superintelligence Labs,方向涵盖机器人控制、自主学习与全身人形控制,外界将此举视为Meta面向AGI布局的一环。

Sony AI乒乓球机器人Ace在正式赛事中击败职业选手,研究登上《自然》;Honor人形机器人Lightning以50分26秒完成半程马拉松,打破人类世界纪录。Physical AI能力快速迭代。
