qbitai 资讯 热度 26

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

AI 导读

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

查看原文 ↗ 返回热榜

二次创作声明:本页为 AI 热榜聚合导读,内容与热度数据来自公开来源 (qbitai),版权归原始作者所有;本站仅做转载指引与摘要评述,不复制原文。