星尘智能发布异步强化学习框架SmoothRL
工具AI 评分 75/100量子位待复核
AI 摘要
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
星尘智能基座模型团队推出SmoothRL,这是一个能够异步执行的在线强化学习框架,旨在解决机器人不能停下来等待模型的问题,使在线强化学习能够跟上大模型的异步推理速度。
为什么值得看
该框架解决了机器人实时决策与模型异步推理之间的速度不匹配问题
大模型强化学习
信源1 家
关键事实
相关 · 工具
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
