
Scaling 分歧之外,三位 AI CEO 为什么同时把监管交给政府?
Demis Hassabis、Sam Altman 与 Dario Amodei 在近五周内先后呼吁政府参与前沿 AI 安全规则,但 FINRA 式标准机构、美国主导国际论坛与可阻止高风险部署的联盟方案,并不是同一套监管设计。
先说结论
过去五周,Demis Hassabis、Sam Altman 和 Dario Amodei 先后把一个原本容易被视为行业自律的问题,推向了政府和民主机构的责任范围:前沿模型能否部署、如何测试、谁来判断风险,不应只由开发它们的实验室决定。
这构成了一个真实但有限的共识。三人都支持政府参与规则制定,也都希望有独立技术评估和跨国协调;但他们没有提出同一个机构。Hassabis 要的是一个仿照 FINRA、由联邦监督的行业标准机构;Altman 要的是美国主导的国际论坛;Amodei 在 G7 讨论的则是以美国为中心的民主国家联盟,以及政府在特定高风险情形下阻止部署的权力。123
所以,监管共识并不意味着三家公司的政策已经统一。更准确的判断是:在 Scaling 继续扩张、模型能力开始被视为国家安全基础设施的阶段,三位竞争对手都在要求政府给前沿 AI 设定一条可预期的外部边界;他们对边界由谁执行、对谁开放,以及美国在其中拥有多大主导权,仍有明显分歧。
三个公开节点,连成一条线
Hassabis:先给前沿模型建立「入口考试」
7 月 14 日,Google DeepMind CEO Demis Hassabis 在 Substack 发表长文《A Framework for Frontier AI and the Dawning of a New Age》。他判断 AGI「probably only a few short years away」,并称现在仍有一个可以建立安全机制的「precious window」。14
他的核心方案很具体:建立一个「modelled on a federally overseen public-private partnership or self-regulatory organisation, much like the Financial Industry Regulatory Authority (FINRA)」的标准机构,董事会应包含独立的技术专家和开源代表。前沿实验室最初在模型发布前最多 30 天自愿提交评估,协议被证明有效后,前沿模型必须通过评估才能在美国市场部署。1
这不是把所有 AI 产品交给同一套审批程序。Hassabis 明确把范围限定为达到 Frontier-class 阈值的模型,无论模型来自哪个国家、采用开源还是闭源方式;创业公司和学术机构的非前沿模型则豁免。测试对象包括网络安全、生物风险、智能体绕过安全护栏或出现欺骗行为,以及数字水印和可读输出 token 等可审计实践。15
FINRA 类比的含义也不能只理解成「让行业自己管自己」。FINRA 是私营、非营利的自律组织,受美国证券交易委员会监督,但不属于政府,资金主要来自会员费;它的董事会同时包含行业成员和公共成员。Hassabis 借用的正是这种「行业提供技术和资金、联邦提供监督和合法性」的组合。6
Altman:把规则制定权还给民主机构
7 月 1 日,OpenAI 联合创始人兼 CEO Sam Altman 在《金融时报》发表署名文章。他提出建立一个美国主导的国际论坛,负责制定被广泛接受的 AI 安全标准,提供关于能力与风险的专家、公正分析,并向参与和遵守规则的国家及公司提供前沿技术访问。2
Altman 对治理边界的表述比机构名称更重要:「Democratic institutions must not cede their responsibilities to AI labs. The labs develop the technology, but citizens and their elected representatives must make the rules.」他还主张,论坛可以包含政府代表和独立技术专家,并对实验室形成治理约束,以抵御商业压力带来的不安全竞赛。2
这一路线的重点不是先设计一套美国境内的模型准入测试,而是先确立规则的政治来源:AI 公司负责开发,公民及其民选代表负责定规则。OpenAI 随后在官方文章中再次写明,涉及前沿安全的关键决定应由民主政府作出,而不应只由前沿实验室决定。7
但 Altman 的框架也带着一个无法回避的限定词:美国主导。金融时报 Lex 专栏认为,这种秩序可能给包括 OpenAI 在内的美国大型公司带来结构性优势;两位学者在金融时报读者来信中则批评方案没有把联合国放在核心位置。它们都指出,同一套规则既可能减少各国各自限制的碎片化,也可能把美国公司的产业优势写进全球制度。89
Amodei:政府不仅定规则,还要能叫停部署
6 月 17 日,在法国 Évian 举行的 G7 峰会 AI 工作午餐上,Anthropic CEO Dario Amodei 与 Altman、Hassabis 等科技公司负责人同席。会议是闭门形式,没有公开逐字稿。金融时报引述知情人士称,Amodei 要求 G7 领导人「resist the temptation to splinter」,不要在先进 AI 部署上各自分裂;CNBC 则报道,他与 Hassabis 一起呼吁建立美国主导的 AI 联盟,合作范围包括前沿模型的结构化访问、排除中国的芯片和关键组件贸易,以及应对网络、生物恐怖主义和情报风险。310
因此,Amodei 的「监管」从一开始就和地缘政治绑在一起。G7 讨论的不是抽象的全球标准,而是谁能访问前沿模型、谁能获得芯片、民主国家如何共同应对高风险能力。这个范围比 Hassabis 的测试机构更宽,也比 Altman 的规则论坛更明确地划出了对华边界。
他的个人政策文章《Policy on the AI Exponential》提供了更清楚的机制背景,但它不是 G7 会议逐字稿,只能作为背景材料。Amodei 主张,前沿模型像飞机一样,应接受强制性的第三方技术测试和审计;如果评估认为模型在网络安全、生物武器、AI 失控或加速这些风险的自动化研发方面存在不可接受风险,政府应有权阻止或遏制部署,同时设置防止政治偏袒和任意决定的保护措施。11
这也解释了 Amodei 与另外两人的差别:他不只要求政府拥有规则制定权,还明确要求政府拥有在有限风险类别内的执行权。只是目前能直接归属于 G7 场合的内容来自匿名消息人士转述,不能把政策文章中的完整制度主张全部当作当天的公开发言。
共同方向是真的,完整方案并不一致
| 维度 | Hassabis | Altman | Amodei |
|---|---|---|---|
| 谁制定规则 | 联邦监督下的行业标准机构,董事会纳入独立技术专家和开源代表。1 | 美国主导的国际论坛,包含政府代表和独立技术专家。2 | 民主国家联盟协调,政府应拥有针对特定风险的阻止或遏制部署权。11 |
| 技术机制 | 发布前评估,先自愿、后可能强制;基准可以按季度更新。1 | 标准、能力与风险的专家公正分析,并作为实验室治理机制。2 | 第三方测试和审计,不达高安全标准可阻止或逆转发布。11 |
| 地缘边界 | 美国先行,但主张覆盖所有国家来源、开源和闭源的前沿模型。1 | 美国主导,并把遵守规则与前沿技术访问联系起来。2 | 以民主国家联盟为主体,G7 讨论包含排除中国的芯片和关键组件贸易。10 |
| 目前证据强度 | 有本人公开长文,制度细节最完整。1 | 有本人金融时报署名文,并有 OpenAI 官方文章重申。27 | G7 具体措辞来自金融时报和 CNBC 对匿名消息人士的交叉转述,政策文章可作背景但不是会议记录。310 |
共同点因此很清楚:三人都不再把「安全」仅仅定义成公司内部的红队测试或发布后的承诺,而是要求外部机构介入前沿模型的判断。分歧也同样清楚:谁来组成外部机构、美国主导是否足以代表全球、以及不合格模型究竟是暂缓、禁止,还是失去访问资格。
为什么监管会在此时变成共识
第一,前沿模型的风险已经被这些公司自己放进国家安全语境。Hassabis 在长文中把网络安全放在已出现的挑战里,并把核与生物风险列为能力继续提高后可能出现的威胁;Amodei 则把 AI 描述为可能成为任何国家军事和经济力量的主要来源。511
第二,模型发布已经不再完全由实验室单方面决定。金融时报报道,美国政府正在与 AI 公司谈判新的模型发布自愿标准;这发生在美国政府对 Anthropic 模型访问施加出口管制、并对模型发布采取临时性干预之后。对实验室而言,一个公开、稳定、技术化的评估框架,至少有机会替代每次危机发生后再由行政部门临时决定。12
第三,监管机构本身也会重排竞争格局。FINRA 的会员费模式说明,行业自律并不等于没有利益关系;金融时报 Lex 对 Altman 方案的批评则指出,昂贵的合规体系可能更有利于资金充足的大公司。对前沿模型来说,关键问题不只是测试能否发现风险,还包括谁出钱、谁定义 Frontier-class 阈值、谁能申诉,以及开源项目如何承担与闭源实验室相同的评估义务。68
这不是说三人的提议因此失去价值,而是说明「行业欢迎监管」不能直接等同于「监管已经独立」。越是由行业提出的标准,越需要把利益冲突、董事会构成、资金来源和公开申诉程序写进制度,而不能只停留在「独立」和「公正」这两个形容词上。
接下来观察四个制度动作
真正能验证这场共识的,不是三位 CEO 是否继续发表类似声明,而是以下问题能否得到可执行的答案:
- 前沿模型的门槛如何定义。 Hassabis 方案明确区分 Frontier-class 与非前沿模型,但没有在公开文章中给出完整阈值。阈值若过低,会把大量普通模型纳入昂贵审查;若过高,则可能放过能通过组合调用产生高风险能力的系统。
- 测试结果是否能影响发布。 自愿提交、第三方审计、政府阻止部署和市场准入是不同强度的机制。要看最终方案是给出风险报告,还是把通过测试设为美国市场的硬条件。
- 机构是否真的独立。 需要公开董事会席位、行业资金比例、专家遴选、开源代表的定义、测试协议和申诉渠道。没有这些信息,「行业主导」很容易滑向「行业自定规则」。
- 美国主导能否获得更广泛合法性。 Altman 的方案把技术访问与遵守规则联系起来,Amodei 的 G7 方案把联盟和芯片贸易放在一起;欧洲、联合国以及不在联盟中的国家是否接受这种安排,将决定它是国际标准,还是美国及其盟友的准入体系。2910
上一期讨论的是 Sutskever 与 Amodei 对「Scaling 还剩多少空间」的分歧。这一期出现的变化不是他们在技术路线上达成了一致,而是无论模型能力沿哪条路线增长,三位 CEO 都开始承认同一个治理前提:前沿 AI 的部署边界不能只由前沿 AI 公司自己决定。下一场真正重要的争论,将从「要不要监管」转向「谁来测、按什么测,以及谁有权让模型停下来」。
Fuentes de referencia
- 1Demis Hassabis:A Framework for Frontier AI and the Dawning of a New Age
- 2Sam Altman:This is how we can make AI safe for everyone
- 3Anthropic boss tells G7 leaders to resist the temptation to splinter over AI
- 4Google DeepMind CEO Issues Stark Warning About AGI
- 5Google DeepMind chief calls for U.S. to lead AI standards body
- 6About FINRA
- 7The US is advancing AI safety through state and federal action
- 8Altman's AI safety proposal: let us win, or everybody loses
- 9Letter: The UN must be at the heart of AI governance
- 10Anthropic and Google DeepMind CEOs call for U.S.-led AI coalition at G7
- 11Policy on the AI Exponential
- 12White House accelerates plans for AI model standards
Contenido relacionado
- Inicia sesión para comentar.
