返回行业动态
行业与市场

Anthropic 公布首个嵌入式独立评估方:埃森哲进驻实验室,双方各投至少 10 亿美元

2026 年 9 月 18 日,Anthropic 与埃森哲宣布合作,由埃森哲旗下 AI 业务部门 Faculty 牵头组建嵌入式评估团队,进驻 Anthropic 内部对其前沿模型开展评测、红队测试、对齐评估与安全护栏验证,双方各自预计在未来五年投入至少 10 亿美元。这被视为 Anthropic CEO 阿莫代伊《We Must Pace the Frontier》一文中「嵌入评估人员」承诺的首次落地,也是前沿实验室首次引入常驻型第三方评估方。争议集中于资金来源:Anthropic 直接出资支持埃森哲的工作,长期则主张改由资金池或政府出资。

来源:Anthropic(官方公告)原标题:Partnering with Accenture on embedded evaluation查看原文
深蓝青绿色调的 AI 实验室内部:中央一道发光的青色垂直光门,两侧为成排深色网孔机柜与指示灯,前景左右各有一组空置工作台与座椅,顶部有中文标题「独立评估方进驻实验室」

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

2026 年 9 月 18 日,Anthropic 与埃森哲(Accenture,NYSE: ACN)宣布建立合作关系,由埃森哲旗下 AI 业务部门 Faculty 牵头,组建一支「嵌入式评估」团队进驻 Anthropic,对其前沿模型进行评测与红队测试、开展对齐评估,并验证安全护栏的有效性。双方各自预计在未来五年内投入至少 10 亿美元用于建设相关评估能力;按埃森哲新闻稿与路透社的报道口径,合计下限约 20 亿美元。消息公布当日,埃森哲股价在盘后交易中明显走高,多家媒体给出的涨幅在 6.5% 至 8% 之间。

与既有「外部评估」的关键区别

  • 访问级别:Anthropic 官方表述为「与员工相当的访问权限」(access comparable to an employee's),评估人员可观察模型在训练中成型的过程、追踪影响模型构建与部署的内部决策,并直接与员工交谈。
  • 常驻而非窗口期:不同于以往按次开展的第三方测评(评估期常以数天计),嵌入式评估为常驻形态,官方未设置期限上限。
  • 可报告性:评估方可以就风险水平、事件以及自己获得或未获得的访问权限公开发表结论,Anthropic 表示无权仅因结论不利而删改。
  • 机制定位:这是 Anthropic CEO 达里奥·阿莫代伊 9 月发表的《We Must Pace the Frontier》中「嵌入评估人员」承诺的第一步落地。

资金模式与独立性争议

一个被反复指出的结构性问题是资金来源。Anthropic 在公告中明确表示,考虑到这项工作的重要性和紧迫性,「将由 Anthropic 直接出资支持埃森哲的工作」,同时主张长期应改由资金池或政府来源承担,并称正与 METR 等非营利评估机构商谈,由后者使用自有资金试点部分嵌入式评估。批评意见认为,由被评估方付费给评估方,难以称为真正意义上的独立。另一类质疑指向评估质量本身:近期公开的两项独立评测,其窗口分别只有 3 天与约 6 天,且范围受限于单一模型或检查点;支持者则认为,「常驻 + 员工级权限 + 可观测训练过程」可能是近两年 AI 安全治理中最具实质性的一步改进。

对企业读者的意义与不确定之处

  • 采购侧影响:通过埃森哲渠道采购 Claude 的企业,其安全结论与事件可见度可能开始经由一家同时销售部署服务的咨询机构流转,报告权与独立性安排值得跟踪。
  • 非排他安排:Anthropic 称该合作非排他,未来数周将公布更多评估方;埃森哲也可为其他 AI 开发商提供同类服务。目前尚无迹象显示 Meta 与 Google DeepMind 跟进同类承诺。
  • 标准缺位:官方承认,目前尚无标准规定嵌入式评估人员应获得哪些信息、应如何报告其发现;合同细节未公开,付费模式被官方自身视为过渡态。
  • 口径提示:公告中的 10 亿美元是预期投入下限,并非已经实际支出的金额。
编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。