机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

摘要 · 星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
阅读原文 · 量子位
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理具身智能

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

原文:https://www.qbitai.com/2026/09/484437.html

0 条评论 · 观点来自社区

评论区 0 条讨论

的身份发言⌘/Ctrl+Enter 发送
还没有评论,来抢沙发。