ai.hackcv
行业资讯
行业资讯精选 82量子位

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

📎 发布于 09-04 17:19🔗 阅读原文(qbitai.com
相关推荐

本站内容由 LLM 精选聚合,原文版权归 量子位 所有 · 摘录仅供参考