AI 圈大事记

Anthropic 与埃森哲合作开展嵌入式独立评估

行业AI 评分 85/100TechCrunch 等 2 家待复核
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手

本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT

Anthropic 与埃森哲达成合作,开展前沿 AI 的嵌入式独立评估。埃森哲旗下 Faculty 业务将主导模型评估、红队测试及安全防护测试。双方计划在未来五年内各投入至少 10 亿美元以建设相关能力。嵌入式评估员将获得类似内部员工的权限,深入模型训练与部署流程,以验证安全承诺并识别盲点。目前相关标准尚未确立,Anthropic 将直接资助埃森哲的工作。

全文梳理

AI 摘要依据下方信源原文自动整理,非原文转载

合作内容与投入

Anthropic 与埃森哲宣布建立合作伙伴关系,共同推进前沿 AI 的嵌入式独立评估。该合作由埃森哲旗下的专业 AI 业务 Faculty 负责,具体工作涵盖对模型的评估与红队测试、进行一致性评估以及测试模型的安全防护措施。双方均预期在未来五年内,各自投入至少 10 亿美元用于建设该领域的能力。埃森哲凭借其协助企业和政府在各行业部署 AI 的实践经验,将这一视角引入对 Anthropic 模型的评估工作中。

嵌入式评估机制

嵌入式评估作为一种新机制,其运作细节仍在制定中。与现有的外部评估员不同,嵌入式评估员将在 AI 公司内部工作,并获得相当于内部员工的访问权限。这种权限使他们能够观察模型在训练过程中的成型情况,跟踪构建和部署模型的相关决策,并直接与员工沟通。基于这一优势,评估员可以评估公司的运营状况,核实其是否履行安全承诺,发现潜在盲点,并报告事件,从而向公众提供更准确的收益与风险说明。

资金与标准现状

目前,关于嵌入式评估员应获取哪些信息、如何报告发现结果,尚无既定标准,独立的评估资金体系也未确立。长期来看,资金应来源于资金池或政府渠道,但在这些机制建立之前,Anthropic 计划与不同评估员在多种资金安排下合作。鉴于工作的重要性和紧迫性,Anthropic 将直接资助埃森哲的工作,并正与 METR 及其他非营利评估员对话,利用其自有资金试点嵌入式评估的要素。

为什么值得看

头部厂商探索嵌入式评估新机制,巨额投入或重塑 AI 安全审计标准。

Anthropic安全

信源2

  1. [1]TechCrunchAnthropic’s first embedded evaluator is … Accenture?
  2. [2]Anthropic:Newsroom(网页)线索来自 AIHOTAnthropic 与 Accenture 合作开展嵌入式独立评估,双方各投入至少 10 亿美元

关键事实

  • 双方计划在未来五年内各投入至少 10 亿美元。[1]

  • 嵌入式评估员将拥有类似内部员工的访问权限。[1]

  • 合作内容包括模型评估、红队测试及安全防护测试。[1]

相关 · 行业

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。