灵初智能发布Psi-R2.5,逆向生成强配对数据并引入ICL
论文AI 评分 75/100量子位待复核
AI 聚合
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
灵初智能推出Psi-R2.5模型,核心改进数据质量与人机对齐。该方案逆向使用世界模型Psi-W0,从真实机器人轨迹生成对应人手操作,构建场景与时序逐帧对应的“强配对数据”,用于训练带动作输出的视频编辑转换器,产出可真机回放的机器人动作。此外,模型减少重复数据、增加任务多样性并拆解原子动作。同时引入上下文学习(ICL),将人类示范转成机器人数据作为提示,无需更新参数即可适应新任务,配合双层架构(上层拆解长程指令,下层输出轨迹)执行。
为什么值得看
解决人机数据本体差异致真机难执行痛点,用逆向生成与ICL降低新任务训练成本。
对齐
信源1 家
关键事实
相关 · 论文
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
