Anthropic实验:201名员工让Claude智能体代为换书交易
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT
全文梳理
AI 摘要依据下方信源原文自动整理,非原文转载实验设计与偏好匹配
Project Swap实验招募了来自6个办公室的201名员工,每人带一本想送出的书。参与者与Claude进行约5分钟短聊以阐述阅读喜好,随后派出Claude驱动的智能体进入公开交易场,与其他智能体进行推销、讨价还价及达成交易,目标是换得一本自己会喜欢的夏日读物。参与者还根据兴趣对10本书进行排序以评估智能体的代理效果。结果显示,仅凭5分钟对话,智能体对书籍的排序与人类本人在61%的排序对上保持一致,在极短交流下展现出较好的偏好捕捉能力。
交易表现与模型影响
在交易场上,智能体展现出良好的交易能力。市场未能达到最优状态的主要原因,在于智能体对参与者缺乏足够深入的信息,而非其交易策略本身存在缺陷。研究团队将每个交易场重新运行数十次,并更换底层模型与智能体指令。对比发现,智能体所运行的底层模型对其谈判结果的影响,显著超过了所给予的指令。搭载更强模型的智能体在交易中表现更佳,使得整体市场效率更高。
结果反馈与代理意愿
从最终结果来看,大多数换到书并阅读了的参与者表示喜欢这本书。在代理意愿方面,平均每位参与者表示,愿意将自身年度购书预算的大约三分之一交由Claude来支配花费。这反映出在特定垂直场景下,人类对AI智能体代为执行谈判与交易具有一定信任基础。该实验也指出了生活中大量因寻找交易方与谈判成本过高而错失的互利交易,未来或可由智能体代为促成。
为什么值得看
揭示AI智能体在代理人类谈判交易时的表现与局限,证明底层模型能力比指令更决定交易效率。
信源1 家
关键事实
相关 · 论文
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
