行业2026-09-05 01:19👁 0 机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理 星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL 以上为资讯摘要,完整内容请访问原文网站。 阅读原文 →