量子位·· 2026-09-04评分71
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
摘要
事实摘要:机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理 星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL 这条动态来自 量子位,可重点关注模型能力与工程、产品发布。 机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理 星尘智能(Astribot) 。影响判断:它可能改变模型能力与工程相关的产品判断、研究节奏或内容生产方式。场景价值:适合用于跟踪模型能力与工程方向的选题、竞品观察和落地方案筛选。
本站只提供摘要与原文入口。完整内容请阅读原文。
来源:量子位 · qbitai.com