机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
AI 导读
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
二次创作声明:本页为 AI 热榜聚合导读,内容与热度数据来自公开来源 (qbitai),版权归原始作者所有;本站仅做转载指引与摘要评述,不复制原文。
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
二次创作声明:本页为 AI 热榜聚合导读,内容与热度数据来自公开来源 (qbitai),版权归原始作者所有;本站仅做转载指引与摘要评述,不复制原文。