Anthropic 与埃森哲合作开展嵌入式独立评估
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT
全文梳理
AI 摘要依据下方信源原文自动整理,非原文转载合作内容与投入
Anthropic 与埃森哲宣布建立合作伙伴关系,共同推进前沿 AI 的嵌入式独立评估。该合作由埃森哲旗下的专业 AI 业务 Faculty 负责,具体工作涵盖对模型的评估与红队测试、进行一致性评估以及测试模型的安全防护措施。双方均预期在未来五年内,各自投入至少 10 亿美元用于建设该领域的能力。埃森哲凭借其协助企业和政府在各行业部署 AI 的实践经验,将这一视角引入对 Anthropic 模型的评估工作中。
嵌入式评估机制
嵌入式评估作为一种新机制,其运作细节仍在制定中。与现有的外部评估员不同,嵌入式评估员将在 AI 公司内部工作,并获得相当于内部员工的访问权限。这种权限使他们能够观察模型在训练过程中的成型情况,跟踪构建和部署模型的相关决策,并直接与员工沟通。基于这一优势,评估员可以评估公司的运营状况,核实其是否履行安全承诺,发现潜在盲点,并报告事件,从而向公众提供更准确的收益与风险说明。
资金与标准现状
目前,关于嵌入式评估员应获取哪些信息、如何报告发现结果,尚无既定标准,独立的评估资金体系也未确立。长期来看,资金应来源于资金池或政府渠道,但在这些机制建立之前,Anthropic 计划与不同评估员在多种资金安排下合作。鉴于工作的重要性和紧迫性,Anthropic 将直接资助埃森哲的工作,并正与 METR 及其他非营利评估员对话,利用其自有资金试点嵌入式评估的要素。
为什么值得看
头部厂商探索嵌入式评估新机制,巨额投入或重塑 AI 安全审计标准。
信源2 家
关键事实
相关 · 行业
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
