Designer-RSI框架通过演化程序记忆提升智能体图形设计成功率
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
全文梳理
AI 摘要依据下方信源原文自动整理,非原文转载程序记忆的拓宽与深化
该框架的核心是外部程序记忆,包含自然语言形式的设计技能。记忆演化包含两种机制:一是“拓宽”,针对反复出现且现有技能无法覆盖的子任务,自动获取新技能加入库中;二是“深化”,利用技能自身成功与失败的执行轨迹,对已有技能进行修正。为防止修正过程破坏原本能成功的案例,框架引入了匹配重放门,仅允许修复失败且不导致成功退化的变更通过。整个过程无需模型权重更新与人工标注。
实验数据与性能提升
基于1406份真实用户需求与1869条自动评分轨迹进行5轮演化后,技能库从文档衍生的76个技能增长至139个。在Claude-Sonnet-4上,GenEval2执行成功率由72.7%跃升至99.3%,生成质量提升11.99分。在四个专业设计基准测试中,对比无技能智能体,Claude-Sonnet-4与Claude-Opus-4.6分别取得了61.8%和67.6%的胜率。在200份未见过的用户流量基准需求上,单独拓宽或深化的胜率分别为49.4%和48.6%,而两者结合则达到58.5%(p=0.025),证明了两种机制组合的有效性。
对智能体持续适应的意义
专业图形设计属于长周期智能体任务,由大量相互依赖的动作生成结构化可编辑产物,且结果缺乏可靠的程序化检验标准。Designer-RSI表明,在模型参数冻结的前提下,程序记忆为智能体在噪声大、反馈不可验证的环境中实现持续适应提供了一条实用路径。通过不断从执行经验中积累和修正技能,智能体能够有效应对复杂的专业软件操作任务。
为什么值得看
无需更新权重与人工标注,仅靠程序记忆的拓宽与深化即可大幅提升智能体在长周期、不可验证反馈任务上的表现,为智能体持续进化…
信源1 家
关键事实
相关 · 论文
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
