
嵌入式评估者第一单:Anthropic 出钱,请埃森哲进来看自己
Anthropic 9 月 18 日定下第一位常驻评估者:埃森哲的 Faculty,双方各投至少 10 亿美元,而 Anthropic 直接出资;本期把两份公告的措辞差异、这位评估者的来历、它和被评估方既有的生意,以及这笔安排与 Anthropic 自家政策文本、评估者共同体最低条件之间的落差逐条摆出来。
2026 年 9 月 18 日,Anthropic 在官网上挂出一篇公告,标题是《Partnering with Accenture on embedded evaluation》。1
同一天,埃森哲在自家新闻稿里用了另一个标题:《Accenture and Anthropic Partner to Build Team of Embedded Evaluators at Anthropic》。2
两份文件说的是同一件事:埃森哲的 AI 业务部门 Faculty 会派一支团队,以员工级的访问权限进入 Anthropic 内部,长期驻场做评估。31
六天前,Dario Amodei 在长文《We Must Pace the Frontier》里提出了一套三步方案,第一步叫「嵌入式评估者」,另外两步是民主国家之间的协调与全球协调,他当时的写法是「Anthropic 现在单方面承诺这一步」。34
这个承诺有了第一份落到纸面上的安排,而付钱的一方,就是被评估的那一方。
01 公告写了什么
负责牵头的是 Faculty;Anthropic 把 Faculty 称为「埃森哲的专业 AI 业务」。31
要做的三件事写得很具体:对模型做评估与红队测试,做对齐评估,测试模型的保障措施。31
钱的口径是两家各自预计在未来五年内投入至少 10 亿美元。31
「预计」这个词在两份文件里都是原词。Anthropic 写的是 "each expect to invest",埃森哲也写 "each expect to invest",两家都没有用「承诺投入」。3132
两家对这笔钱投在什么上的说法还不一样。Anthropic 写的是 "building capacity in this area",在这一领域建设能力;埃森哲写的是 "in AI safety",投在 AI 安全上。3132
合作是非排他的。Anthropic 写明自己会再与其他评估者合作,也写明埃森哲会以类似身份服务其他 AI 开发者。31
同时推进的还有一条线:Anthropic 说正在与 METR 以及其他非营利评估者商谈,用这些机构自己的资金试点嵌入式评估的各个要素。31
真正值得逐字读的,是这份公告自己列出的缺口。
它写着,眼下还没有标准规定嵌入式评估者应当拿到哪些信息,也没有标准规定它们应当如何报告发现,另外还「没有一个既定的独立评估资金体系」。31
与这句缺口并列的,是 Anthropic 给出的长期方向:资金应当来自政府或池化资金,这是它 6 月那份《Advanced AI Framework》里的主张。531
缺口与方向都写在同一份公告里,等于 Anthropic 自己承认:这套做法当下是权宜。
埃森哲那份稿子的写法是另一回事。
它全篇没有出现过「独立」这个词,用的说法是「建立一支嵌入式评估者团队」。谁出钱、排他不排他、METR 与非营利评估者,这三件事在埃森哲的稿子里一个字都没有。32
埃森哲给出的两句高管表态也都避开了独立性。董事长兼 CEO Julie Sweet 说的是「安全既需要深厚的技术专长,也需要清楚理解 AI 在现实世界如何被使用」;Faculty CEO Marc Warner 说的是这句:
"Faculty, which is now part of Accenture, was founded on the belief that AI should be safe by design, not safe by accident."Faculty 成立时的信念,是 AI 应当天生安全,而不是碰巧安全。32
02 来的这家评估者是谁
交割时并入埃森哲的,是 400 多名 AI 专业人员。33
Faculty 的联合创始人兼 CEO 是 Marc Warner。收购完成后,他同时出任埃森哲首席技术官,并进入埃森哲的全球管理委员会。9 月 18 日这份公告里,他的头衔仍然写成 "chief technology officer, Accenture and CEO, Faculty",一人两职。3234
这家公司做过评估,而且点名做过 Anthropic 的。
Faculty 官网的评估与红队页面写着,包括 OpenAI、Meta 和 Anthropic 在内的前沿实验室请他们帮忙让最强的模型变安全;同一页举的例子是「从参与设计 Anthropic Claude 4 模型的生物安全评估,到在 OpenAI o1 模型发布前对它做红队」。10
埃森哲的收购稿还写到,Faculty 与英国 AI 安全研究院(UK AI Security Institute)等机构合作,对通用模型做基线安全评估。33
派来这支团队的机构,背后是一家体量极大的母公司。埃森哲在 9 月 18 日这篇稿子里给自己的口径是约 79.9 万人、约 9000 家客户、上一财年营收约 700 亿美元。32它 2025 年 9 月 25 日发布的 FY2025 财报给出的精确数字是营收 696.7 亿美元,其中生成式 AI 的新增订单 59 亿美元。11
03 埃森哲与 Anthropic 还有别的生意
埃森哲与 Anthropic 的合作早于这次评估。
2025 年 12 月 9 日,两家宣布成立「Accenture Anthropic Business Group」,约 3 万名埃森哲专业人员接受 Claude 培训,埃森哲成为 Claude Code 的 premier AI partner(首选 AI 合作方),Claude Code 向它的数万名开发者开放。12
Amodei 在那篇稿子里的原话是:
"Our new partnership means that tens of thousands of Accenture developers will be using Claude Code, making this our largest ever deployment."我们的新合作意味着数万名埃森哲开发者将使用 Claude Code,这将成为我们有史以来最大的一次部署。35
埃森哲自己维护的生态伙伴页面到今天还挂着两个数字:3 万多名受过部署 Claude 解决方案训练的专业人员,6000 名 Anthropic 认证架构师。13
同一家公司也在给别家做类似的事。埃森哲 2026 年 5 月与 OpenAI 签了面向美国联邦政府的合作,2026 年 9 月 8 日又与 Google Cloud 成立了 Gemini Enterprise Business Group。1415
至于埃森哲是否持有 Anthropic 的股权或者有收入分成,公开材料里查不到。两家的所有官方稿件都没有提过这类安排,用 "Accenture" 加 "Anthropic" 在美股 EDGAR 全文检索也是零条。3235
把这三段放在一起,是一句可以核对的话:这个要来评估 Anthropic 的机构,同时是替它把 Claude 卖进企业的交付伙伴,也是它的大客户。
前一天,100 多位评估者联名发出的公开信里,第一条最低条件恰好管这件事。
这封信一共提了五条:实质独立、多机构多视角、透明与限缩保密协议、防报复与资金保障、员工级特权访问。第一条要求嵌入式评估机构「不应被前沿 AI 公司拥有或治理,不应与它们有其他重大商业往来,也不应接受任何与结论挂钩的报酬」。16
04 钱从谁手里出
公开信第五条管的是访问权限,第四条管的是钱。
第四条原文要求:评估者因为选择合理的评估方法、发现某些信息,或者得出对公司不利的结论而遭到报复时,要有保护,包括针对报复性诉讼的合理防护,「以及一套资金机制,让它们相信即使出现这种情况,机构仍然拿得到钱」。36
信里没写这套机制的钱应该由谁出。Anthropic 这次给出的答案很清楚:自己出。
公告的原句是 "Given the importance and urgency of this work, Anthropic will fund Accenture's work directly",鉴于这项工作的重要与紧迫,Anthropic 将直接资助埃森哲的工作。31
要判断这句话的分量,最合适的尺子是 Anthropic 自己 6 月那份政策文件。
《Advanced AI Framework》是它写给美国联邦政府的提案。在独立评估那一节里,它要求评估者 "should be independent in the sense of not having a financial interest in the developer",也就是说,评估者在「对开发者没有财务利益」这层意义上应当是独立的。37
同一节接着写,政府应当出资或者安排池化资金,让评估者「在财务上独立于任何单一开发者」地开展工作,还要给刚起步的评估机构提供资源与资金。37
这份文件还点名了一个风险,叫 "evaluator shopping"(挑选评估者):公司会去找那个要求最少、给分最松的评估者;它给出的解法是由政府机构按公开标准给评估者评级,高风险场景下的评估者随机指派。37

这套主张与 9 月 18 日这份公告之间的距离,公告自己没有回避。
它承认没有既定的资金体系,也承认长期应该走政府或池化资金,然后说明当下这两种渠道都不存在,所以打算与不同的评估者在不同的资金安排下合作。31
有人替这笔钱的结构做了辩护。
TechCrunch 的记者认为,埃森哲是一家早于 AI 革命存在的大型上市公司,它并不依附于围绕 Anthropic 的那套生态,因此在功能上更独立。38
在 Encode AI 任总法律顾问的 Nathan Calvin 给的是一个更细的切分:埃森哲在文化上对 Anthropic 更独立,在激励上更不独立,因为 METR 是非营利、使命就是透明,哪怕这跟它的客户对着干,而埃森哲是一门生意,希望客户喜欢自己。17
比钱更值得摆在一起看的,是掏钱的机制本身。METR 的官方账号今年 8 月写过自己的资金结构:不接受前沿 AI 公司给的钱,也不接受这些公司或其员工安排的捐赠;这些公司目前为它的评估与研究免费提供大量 token。18
公告说要走政府和池化资金,METR 眼下的做法靠的是捐赠;两种机制的差别,落在了「被评估方能不能给自己请的评估者付钱」这一步上。3139
05 这份公告没写细的三件事
第一件是发表权与删改权。
Amodei 在 9 月 12 日的长文里写得相当细:外部评审者有权发表关于风险等级、事件、做法以及他们所获访问权限的关键发现,"without editorial control by Anthropic",不受 Anthropic 的编辑控制;公司只保留在安全敏感、法律特权、商业敏感、第三方保密这四类信息上的删改能力,而且 "can't redact findings just because they are unfavorable",不能仅因为结论不利就删改;评审者还可以公开说明某次删改是否拿掉了对其结论重要的内容。40
9 月 18 日的公告里,这些都没有出现。31
这里有一处需要提醒的混用。一家媒体在报道里把这笔交易描述成「评估者可在不受编辑控制的情况下发布发现,但 Anthropic 保留针对敏感材料的有限删改权」;这些条款出自 Amodei 的长文,在 9 月 18 日的公告里找不到。读者容易把长文里的承诺错记成公告当天给出的条款。1940
第二件是报酬与结论的关系。
公告写了 Anthropic 直接出钱,没有写这笔钱与结论是否挂钩。31
对照组摆在那里。OpenAI 2025 年 11 月发布的外部测试政策里,关于报酬的原句是 "No payment is ever contingent on the results of a third party assessment",第三方评估的报酬永不与结论挂钩。20
第三件是员工级访问权限的例外范围。
公告的写法是 access comparable to an employee's,与员工相当的访问权限,具体列了三样:观察训练中的模型成形、跟踪决定模型如何被建造与部署的那些决策、直接与员工交谈。31
Amodei 的长文列得更细,而且写明了例外:办公室里的工位、门禁卡、公司电脑;工作空间、工具与权限大体上与内部风险评估团队相当,法律或合同要求的地方以及保护客户与合作伙伴隐私的地方除外;还要建立内部规范,保障评审者能接触到相关信息,包括与员工实时对话。40
公告给的三样是承诺,长文里的例外是边界;边界写不写下来,决定了这支团队能走到多深。3140
06 同一周里,别人在做什么
OpenAI 那边停在表态。
9 月 12 日,Sam Altman 回复 Amodei 时说 "Committing to having independent evaluators with employee-like access is a great idea, and we will do the same",让独立评估者拥有接近员工的访问权限是个好主意,我们会照做。21
到北京时间 9 月 19 日早上,OpenAI 的官网与官方账号上还没有出现访问细则。它现行的外部测试政策仍然要求第三方评估者签保密协议,发表内容须经公司审阅批准。4142
Google DeepMind 这边,Demis Hassabis 在 9 月 12 日把话题转回了自家 7 月提出的行业标准机构方案;该公司的《Frontier Safety Framework》v3.1 里对应「引入外部方」的只有一句 "Where required or appropriate, involve external parties",在需要或合适的时候引入外部方。2223
评估者共同体这次基本没有说话。
截至北京时间 9 月 19 日早上,METR 的官方账号在 9 月 16 日之后没有发帖;公开信发布六个小时后这笔交易官宣,此后 AI 评估者论坛的账号也没有发帖;署名名单最前面的四个名字——Geoffrey Hinton、Stuart Russell、Arvind Narayanan、Yejin Choi——同样没有找到他们就这笔交易的公开表态。242536
公开质疑来自评论者和媒体。
Gary Marcus 的那句最短:"It ain't independent if you are partnering with them and chose the partner."你与对方合作、伙伴又是你自己挑的,那就不叫独立。26
彭博社在报道正文里加了一句自己的判断:考虑到埃森哲与这些大型 AI 初创公司之间的紧密关系,这一合作的「第三方」性质势必将引来质疑。27
《纽约邮报》的动作最重。它引述华盛顿 AI 政策团体 Alliance for the Future 主席 Perry Metzger 的话:"None of these people are independent, none of these people are arm's length."这些人一个都不独立,一个都没有保持距离。同一篇里,众议院 AI 委员会联席主席、新泽西州民主党众议员 Josh Gottheimer 的说法是:"When AI developers cheer on the framework meant to hold these companies accountable, it should raise red flags, not confidence."当 AI 开发者们为那个本该约束他们自己的框架叫好时,这应该拉响警报,而不是让人更有信心。28
这篇报道里还有一句需要打折扣的话:它写这笔合作是在该报向 Anthropic 要求置评之后才宣布的。这句话是《纽约邮报》自己的因果叙述,Anthropic 的公告与官方帖子都没有这层说法。3143
07 接下来看什么
第一,这份安排的条款会不会公开。 发表权、删改的范围、与员工一对一沟通的权利、评审者被起诉之后怎么办,这四样现在只有 Amodei 长文里的描述。条款公开与否,决定这笔安排事后能不能被逐条核对。3140
第二,METR 那条试点由谁出钱。 公告说与非营利评估者的试点要用它们自己的资金;这条线一旦走通,「直接出资」就是孤例而不是范式。3139
第三,Anthropic 说的其他评估者是谁。 公告写的是 "to be announced in the coming weeks",未来几周内公布;到 9 月 19 日早上还没有名字。31
第四,埃森哲会不会真的给别家做同样的活。 Anthropic 的公告说会,埃森哲的公告没说;等它自己那一侧出现第二家实验室的名字,这条才成立。3132
第五,公开信第四条有没有人接。 五条最低条件里,防报复与资金保障是唯一一条要花到钱的,此前没有任何一家公司应下。现在出现的是被评估方出钱的版本;那套让评估者敢写难看结论的资金机制,仍然空着。36
References
- 1Partnering with Accenture on embedded evaluation
anthropic.com
- 2Accenture and Anthropic Partner to Build Team of Embedded Evaluators at Anthropic
newsroom.accenture.com
- 3We Must Pace the Frontier
darioamodei.com
- 4
- 5Anthropic's Advanced AI Framework(2026 年 6 月,PDF)
www-cdn.anthropic.com
- 6
- 7Anthropic's first embedded evaluator is Accenture
techcrunch.com
- 8Accenture to acquire Faculty to scale AI capabilities
newsroom.accenture.com
- 9Accenture completes acquisition of Faculty
newsroom.accenture.com
- 10Faculty: AI Evaluations & Red Teaming
faculty.ai
- 11Accenture Reports Fourth-Quarter and Full-Year Fiscal 2025 Results
newsroom.accenture.com
- 12
- 13Accenture × Anthropic 生态伙伴页
accenture.com
- 14
- 15
- 16Minimum Conditions for Embedding Evaluators
aievaluatorforum.org
- 17
- 18METR 官方账号,2026-08-14
x.com
- 19
- 20
- 21
- 22
- 23A Framework for Frontier AI and the Dawning of a New Age
demishassabis.substack.com
- 24METR 官方账号
x.com
- 25
- 26
- 27
- 28
- 29Anthropic 官方公告帖
x.com
- 30Hacker News 提交帖
news.ycombinator.com
- 311
- 322
- 338
- 349
- 3512
- 3616
- 375
- 387
- 3918
- 403
- 4120
- 4221
- 4328
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
