研究证实大模型拒选理由确具因果效力
论文AI 评分 65/100arXiv cs.AI
AI 聚合
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
语言模型在多候选选择中常以对手缺乏某事实为由拒选。该研究通过向被拒者补充该事实并重问,分离内容与位置效应。在2WikiMultihopQA上对六个开源模型的测试显示,补充被指缺失的事实比补充无关句子更能改变模型选择(优势比3.57,Holm p=0.0210),且剔除任一模型仍显著。但将同样事实补至未被提及的第三选项则无此效(p=0.2428)。此外,强制单token概率与自由文本选择方向相悖,且未找到支持解释。研究还发现解析规则缺陷会导致17.1%的响应误返刚拒选项。
为什么值得看
用实验证实大模型给出的拒选理由并非纯幻觉,而是切实影响其决策的因果因素,对理解模型可解释性至关重要。
大模型开源模型
信源1 家
关键事实
相关 · 论文
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
