嵌入式评估者第一单:Anthropic 出钱,请埃森哲进来看自己

嵌入式评估者第一单:Anthropic 出钱,请埃森哲进来看自己

Anthropic 9 月 18 日定下第一位常驻评估者:埃森哲的 Faculty,双方各投至少 10 亿美元,而 Anthropic 直接出资;本期把两份公告的措辞差异、这位评估者的来历、它和被评估方既有的生意,以及这笔安排与 Anthropic 自家政策文本、评估者共同体最低条件之间的落差逐条摆出来。

2026 年 9 月 18 日,Anthropic 在官网上挂出一篇公告,标题是《Partnering with Accenture on embedded evaluation》。1
同一天,埃森哲在自家新闻稿里用了另一个标题:《Accenture and Anthropic Partner to Build Team of Embedded Evaluators at Anthropic》。2
两份文件说的是同一件事:埃森哲的 AI 业务部门 Faculty 会派一支团队,以员工级的访问权限进入 Anthropic 内部,长期驻场做评估。31
六天前,Dario Amodei 在长文《We Must Pace the Frontier》里提出了一套三步方案,第一步叫「嵌入式评估者」,另外两步是民主国家之间的协调与全球协调,他当时的写法是「Anthropic 现在单方面承诺这一步」。34
这个承诺有了第一份落到纸面上的安排,而付钱的一方,就是被评估的那一方。

01 公告写了什么

负责牵头的是 Faculty;Anthropic 把 Faculty 称为「埃森哲的专业 AI 业务」。31
要做的三件事写得很具体:对模型做评估与红队测试,做对齐评估,测试模型的保障措施。31
钱的口径是两家各自预计在未来五年内投入至少 10 亿美元。31
「预计」这个词在两份文件里都是原词。Anthropic 写的是 "each expect to invest",埃森哲也写 "each expect to invest",两家都没有用「承诺投入」。3132
两家对这笔钱投在什么上的说法还不一样。Anthropic 写的是 "building capacity in this area",在这一领域建设能力;埃森哲写的是 "in AI safety",投在 AI 安全上。3132
合作是非排他的。Anthropic 写明自己会再与其他评估者合作,也写明埃森哲会以类似身份服务其他 AI 开发者。31
同时推进的还有一条线:Anthropic 说正在与 METR 以及其他非营利评估者商谈,用这些机构自己的资金试点嵌入式评估的各个要素。31
真正值得逐字读的,是这份公告自己列出的缺口。
它写着,眼下还没有标准规定嵌入式评估者应当拿到哪些信息,也没有标准规定它们应当如何报告发现,另外还「没有一个既定的独立评估资金体系」。31
与这句缺口并列的,是 Anthropic 给出的长期方向:资金应当来自政府或池化资金,这是它 6 月那份《Advanced AI Framework》里的主张。531
缺口与方向都写在同一份公告里,等于 Anthropic 自己承认:这套做法当下是权宜。
埃森哲那份稿子的写法是另一回事。
它全篇没有出现过「独立」这个词,用的说法是「建立一支嵌入式评估者团队」。谁出钱、排他不排他、METR 与非营利评估者,这三件事在埃森哲的稿子里一个字都没有。32
埃森哲给出的两句高管表态也都避开了独立性。董事长兼 CEO Julie Sweet 说的是「安全既需要深厚的技术专长,也需要清楚理解 AI 在现实世界如何被使用」;Faculty CEO Marc Warner 说的是这句:
"Faculty, which is now part of Accenture, was founded on the belief that AI should be safe by design, not safe by accident."
Faculty 成立时的信念,是 AI 应当天生安全,而不是碰巧安全。32
市场当天的反应是涨:路透记的是埃森哲股价盘后上涨 7%,TechCrunch 写的是盘后跳涨 8%,并把这份合作称作「埃森哲有史以来风险最高的一个咨询项目」。67

02 来的这家评估者是谁

Faculty 成立于 2014 年。埃森哲在 2026 年 1 月 6 日宣布收购它,3 月 16 日宣布完成交割,两篇官方稿在金额一栏写的都是同一句话:「交易条款未披露」。89
交割时并入埃森哲的,是 400 多名 AI 专业人员。33
Faculty 的联合创始人兼 CEO 是 Marc Warner。收购完成后,他同时出任埃森哲首席技术官,并进入埃森哲的全球管理委员会。9 月 18 日这份公告里,他的头衔仍然写成 "chief technology officer, Accenture and CEO, Faculty",一人两职。3234
这家公司做过评估,而且点名做过 Anthropic 的。
Faculty 官网的评估与红队页面写着,包括 OpenAI、Meta 和 Anthropic 在内的前沿实验室请他们帮忙让最强的模型变安全;同一页举的例子是「从参与设计 Anthropic Claude 4 模型的生物安全评估,到在 OpenAI o1 模型发布前对它做红队」。10
埃森哲的收购稿还写到,Faculty 与英国 AI 安全研究院(UK AI Security Institute)等机构合作,对通用模型做基线安全评估。33
派来这支团队的机构,背后是一家体量极大的母公司。埃森哲在 9 月 18 日这篇稿子里给自己的口径是约 79.9 万人、约 9000 家客户、上一财年营收约 700 亿美元。32它 2025 年 9 月 25 日发布的 FY2025 财报给出的精确数字是营收 696.7 亿美元,其中生成式 AI 的新增订单 59 亿美元。11

03 埃森哲与 Anthropic 还有别的生意

埃森哲与 Anthropic 的合作早于这次评估。
2025 年 12 月 9 日,两家宣布成立「Accenture Anthropic Business Group」,约 3 万名埃森哲专业人员接受 Claude 培训,埃森哲成为 Claude Code 的 premier AI partner(首选 AI 合作方),Claude Code 向它的数万名开发者开放。12
Amodei 在那篇稿子里的原话是:
"Our new partnership means that tens of thousands of Accenture developers will be using Claude Code, making this our largest ever deployment."
我们的新合作意味着数万名埃森哲开发者将使用 Claude Code,这将成为我们有史以来最大的一次部署。35
埃森哲自己维护的生态伙伴页面到今天还挂着两个数字:3 万多名受过部署 Claude 解决方案训练的专业人员,6000 名 Anthropic 认证架构师。13
同一家公司也在给别家做类似的事。埃森哲 2026 年 5 月与 OpenAI 签了面向美国联邦政府的合作,2026 年 9 月 8 日又与 Google Cloud 成立了 Gemini Enterprise Business Group。1415
至于埃森哲是否持有 Anthropic 的股权或者有收入分成,公开材料里查不到。两家的所有官方稿件都没有提过这类安排,用 "Accenture" 加 "Anthropic" 在美股 EDGAR 全文检索也是零条。3235
把这三段放在一起,是一句可以核对的话:这个要来评估 Anthropic 的机构,同时是替它把 Claude 卖进企业的交付伙伴,也是它的大客户。
前一天,100 多位评估者联名发出的公开信里,第一条最低条件恰好管这件事。
这封信一共提了五条:实质独立、多机构多视角、透明与限缩保密协议、防报复与资金保障、员工级特权访问。第一条要求嵌入式评估机构「不应被前沿 AI 公司拥有或治理,不应与它们有其他重大商业往来,也不应接受任何与结论挂钩的报酬」。16

04 钱从谁手里出

公开信第五条管的是访问权限,第四条管的是钱。
第四条原文要求:评估者因为选择合理的评估方法、发现某些信息,或者得出对公司不利的结论而遭到报复时,要有保护,包括针对报复性诉讼的合理防护,「以及一套资金机制,让它们相信即使出现这种情况,机构仍然拿得到钱」。36
信里没写这套机制的钱应该由谁出。Anthropic 这次给出的答案很清楚:自己出。
公告的原句是 "Given the importance and urgency of this work, Anthropic will fund Accenture's work directly",鉴于这项工作的重要与紧迫,Anthropic 将直接资助埃森哲的工作。31
要判断这句话的分量,最合适的尺子是 Anthropic 自己 6 月那份政策文件。
《Advanced AI Framework》是它写给美国联邦政府的提案。在独立评估那一节里,它要求评估者 "should be independent in the sense of not having a financial interest in the developer",也就是说,评估者在「对开发者没有财务利益」这层意义上应当是独立的。37
同一节接着写,政府应当出资或者安排池化资金,让评估者「在财务上独立于任何单一开发者」地开展工作,还要给刚起步的评估机构提供资源与资金。37
这份文件还点名了一个风险,叫 "evaluator shopping"(挑选评估者):公司会去找那个要求最少、给分最松的评估者;它给出的解法是由政府机构按公开标准给评估者评级,高风险场景下的评估者随机指派。37
Anthropic《Advanced AI Framework》第 7–8 页
图为 Anthropic《Advanced AI Framework》(2026 年 6 月)PDF 第 7 页与第 8 页并排。第 7 页下半是「独立评估」一节的建议条款,其中第一条写着评估者应当「not having a financial interest in the developer」;第 8 页上半是「独立评估者生态」「评估者独立性保障」与「避免 evaluator shopping」三段,其中要求政府出资或安排池化资金,让评估者在财务上独立于任何单一开发者。正文引用之外,这两段可以在原文件里逐字核对。5
这套主张与 9 月 18 日这份公告之间的距离,公告自己没有回避。
它承认没有既定的资金体系,也承认长期应该走政府或池化资金,然后说明当下这两种渠道都不存在,所以打算与不同的评估者在不同的资金安排下合作。31
有人替这笔钱的结构做了辩护。
TechCrunch 的记者认为,埃森哲是一家早于 AI 革命存在的大型上市公司,它并不依附于围绕 Anthropic 的那套生态,因此在功能上更独立。38
在 Encode AI 任总法律顾问的 Nathan Calvin 给的是一个更细的切分:埃森哲在文化上对 Anthropic 更独立,在激励上更不独立,因为 METR 是非营利、使命就是透明,哪怕这跟它的客户对着干,而埃森哲是一门生意,希望客户喜欢自己。17
比钱更值得摆在一起看的,是掏钱的机制本身。METR 的官方账号今年 8 月写过自己的资金结构:不接受前沿 AI 公司给的钱,也不接受这些公司或其员工安排的捐赠;这些公司目前为它的评估与研究免费提供大量 token。18
公告说要走政府和池化资金,METR 眼下的做法靠的是捐赠;两种机制的差别,落在了「被评估方能不能给自己请的评估者付钱」这一步上。3139

05 这份公告没写细的三件事

第一件是发表权与删改权。
Amodei 在 9 月 12 日的长文里写得相当细:外部评审者有权发表关于风险等级、事件、做法以及他们所获访问权限的关键发现,"without editorial control by Anthropic",不受 Anthropic 的编辑控制;公司只保留在安全敏感、法律特权、商业敏感、第三方保密这四类信息上的删改能力,而且 "can't redact findings just because they are unfavorable",不能仅因为结论不利就删改;评审者还可以公开说明某次删改是否拿掉了对其结论重要的内容。40
9 月 18 日的公告里,这些都没有出现。31
这里有一处需要提醒的混用。一家媒体在报道里把这笔交易描述成「评估者可在不受编辑控制的情况下发布发现,但 Anthropic 保留针对敏感材料的有限删改权」;这些条款出自 Amodei 的长文,在 9 月 18 日的公告里找不到。读者容易把长文里的承诺错记成公告当天给出的条款。1940
第二件是报酬与结论的关系。
公告写了 Anthropic 直接出钱,没有写这笔钱与结论是否挂钩。31
对照组摆在那里。OpenAI 2025 年 11 月发布的外部测试政策里,关于报酬的原句是 "No payment is ever contingent on the results of a third party assessment",第三方评估的报酬永不与结论挂钩。20
第三件是员工级访问权限的例外范围。
公告的写法是 access comparable to an employee's,与员工相当的访问权限,具体列了三样:观察训练中的模型成形、跟踪决定模型如何被建造与部署的那些决策、直接与员工交谈。31
Amodei 的长文列得更细,而且写明了例外:办公室里的工位、门禁卡、公司电脑;工作空间、工具与权限大体上与内部风险评估团队相当,法律或合同要求的地方以及保护客户与合作伙伴隐私的地方除外;还要建立内部规范,保障评审者能接触到相关信息,包括与员工实时对话。40
公告给的三样是承诺,长文里的例外是边界;边界写不写下来,决定了这支团队能走到多深。3140

06 同一周里,别人在做什么

OpenAI 那边停在表态。
9 月 12 日,Sam Altman 回复 Amodei 时说 "Committing to having independent evaluators with employee-like access is a great idea, and we will do the same",让独立评估者拥有接近员工的访问权限是个好主意,我们会照做。21
到北京时间 9 月 19 日早上,OpenAI 的官网与官方账号上还没有出现访问细则。它现行的外部测试政策仍然要求第三方评估者签保密协议,发表内容须经公司审阅批准。4142
Google DeepMind 这边,Demis Hassabis 在 9 月 12 日把话题转回了自家 7 月提出的行业标准机构方案;该公司的《Frontier Safety Framework》v3.1 里对应「引入外部方」的只有一句 "Where required or appropriate, involve external parties",在需要或合适的时候引入外部方。2223
评估者共同体这次基本没有说话。
截至北京时间 9 月 19 日早上,METR 的官方账号在 9 月 16 日之后没有发帖;公开信发布六个小时后这笔交易官宣,此后 AI 评估者论坛的账号也没有发帖;署名名单最前面的四个名字——Geoffrey Hinton、Stuart Russell、Arvind Narayanan、Yejin Choi——同样没有找到他们就这笔交易的公开表态。242536
公开质疑来自评论者和媒体。
Gary Marcus 的那句最短:"It ain't independent if you are partnering with them and chose the partner."你与对方合作、伙伴又是你自己挑的,那就不叫独立。26
彭博社在报道正文里加了一句自己的判断:考虑到埃森哲与这些大型 AI 初创公司之间的紧密关系,这一合作的「第三方」性质势必将引来质疑。27
《纽约邮报》的动作最重。它引述华盛顿 AI 政策团体 Alliance for the Future 主席 Perry Metzger 的话:"None of these people are independent, none of these people are arm's length."这些人一个都不独立,一个都没有保持距离。同一篇里,众议院 AI 委员会联席主席、新泽西州民主党众议员 Josh Gottheimer 的说法是:"When AI developers cheer on the framework meant to hold these companies accountable, it should raise red flags, not confidence."当 AI 开发者们为那个本该约束他们自己的框架叫好时,这应该拉响警报,而不是让人更有信心。28
这篇报道里还有一句需要打折扣的话:它写这笔合作是在该报向 Anthropic 要求置评之后才宣布的。这句话是《纽约邮报》自己的因果叙述,Anthropic 的公告与官方帖子都没有这层说法。3143
讨论热度本身不高。官方公告帖到北京时间 9 月 19 日早间有 1419 次点赞、186 次引用、约 25.7 万次浏览;Hacker News 上的提交帖拿到 3 分、0 条评论。2930

07 接下来看什么

第一,这份安排的条款会不会公开。 发表权、删改的范围、与员工一对一沟通的权利、评审者被起诉之后怎么办,这四样现在只有 Amodei 长文里的描述。条款公开与否,决定这笔安排事后能不能被逐条核对。3140
第二,METR 那条试点由谁出钱。 公告说与非营利评估者的试点要用它们自己的资金;这条线一旦走通,「直接出资」就是孤例而不是范式。3139
第三,Anthropic 说的其他评估者是谁。 公告写的是 "to be announced in the coming weeks",未来几周内公布;到 9 月 19 日早上还没有名字。31
第四,埃森哲会不会真的给别家做同样的活。 Anthropic 的公告说会,埃森哲的公告没说;等它自己那一侧出现第二家实验室的名字,这条才成立。3132
第五,公开信第四条有没有人接。 五条最低条件里,防报复与资金保障是唯一一条要花到钱的,此前没有任何一家公司应下。现在出现的是被评估方出钱的版本;那套让评估者敢写难看结论的资金机制,仍然空着。36

References

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10
  11. 11
  12. 12
  13. 13
  14. 14
  15. 15
  16. 16
  17. 17
  18. 18
  19. 19
  20. 20
  21. 21
  22. 22
  23. 23
  24. 24
  25. 25
  26. 26
  27. 27
  28. 28
  29. 29
  30. 30
    Hacker News 提交帖

    news.ycombinator.com

  31. 31
    1
  32. 32
    2
  33. 33
    8
  34. 34
    9
  35. 35
    12
  36. 36
    16
  37. 37
    5
  38. 38
    7
  39. 39
    18
  40. 40
    3
  41. 41
    20
  42. 42
    21
  43. 43
    28

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content