星尘发布SmoothRL异步强化学习框架

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

精选理由

星尘智能出了SmoothRL,让机器人不等大模型也能实时决策,比同步推理效率高多了。

AI 摘要

星尘智能发布SmoothRL框架,解决机器人不能停下来等模型的问题。该框架支持在线强化学习的异步执行,与同步推理相比显著提升效率。SmoothRL专为基座模型团队设计,能够处理实时决策任务。

图片来源 · 量子位
原文 · 量子位

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL