开放权重不是禁令:Anthropic 想管什么Chapters1×0:08开场:Anthropic 的澄清0:47争议与两种风险1:41第一条线:先进芯片2:32第二条线:工业规模蒸馏3:19第三条线:发布前测试4:19结尾:政策对象被重新划线0:005:150:08主播七月二十七日,Anthropic 首席执行官达里奥·阿莫代伊发表「我们对开放权重模型的立场」。最直接的一句话是,Anthropic 从来没有主张禁止开放权重模型。0:23主播开放权重,指模型参数可以被下载、部署和修改。它不等于代码、训练数据和训练流程全部公开。阿莫代伊承认,不具备危险能力的开放权重模型有公共价值,企业、开发者和研究者可以用运行成本获得一个不受供应商随时改动或下线影响的模型。0:47主播这篇文章回应的是一个政策争议:美国政府内部据称在考虑限制美国公司使用中国开放权重模型,随后又有科技公司联名支持开放权重。阿莫代伊认为,按国别或类别禁用,解决不了他最担心的国家安全问题,也可能变成保护美国公司的竞争壁垒。1:11主播他的担忧有两层。第一,威权政府可能把更强的模型藏起来,只交给军队、情报机关或监控系统使用,模型是否公开发布并不是决定性变量。第二,强大模型可能被用于网络攻击、生物攻击或出现严重对齐问题。开放权重一旦发布,复制品能在提供方看不到的地方运行,监控、调整拒答和撤回模型都很困难。1:41主播Anthropic 支持的第一项措施,是不要向中国出售强大的人工智能芯片和制芯设备,并打击走私与转运。阿莫代伊的判断是,训练能力最终受计算资源约束,限制先进芯片比直接限制模型文件更接近风险来源。2:02主播这类风险已经进入执法层面。美国商务部在二〇二五年五月宣布撤销拜登政府的人工智能扩散规则,同时表示会加强全球芯片出口管制。美国司法部今年三月公布一起案件,指控有人用虚假文件和转运安排,把装有受控芯片的服务器送往中国。司法部也明确说,这些仍是起诉书中的指控,被告受无罪推定。2:32主播第二项措施是打击工业规模的模型蒸馏。蒸馏本身是正常技术路线,让较小模型从更强模型的输出中学习,用更少计算得到一部分能力。争议在于,大量假账号和代理服务可能把它变成有组织的能力提取。2:53主播Anthropic 二月称,它识别出三家实验室通过约两万四千个欺诈账号,与 Claude 产生超过一千六百万次交互,提取推理、工具调用和编程能力。这是 Anthropic 对自身调查的归因,不等于独立司法认定,但能解释它为什么把政策靶心放在蒸馏行为,而不是所有开放权重模型。3:19主播第三项措施是让所有足够强的模型,在发布前接受网络安全、生物风险和对齐风险测试,不论开放还是封闭。问题是,「足够强」的阈值由谁定,结果是否公开,跨国执行怎样实现,声明都没有回答。3:38主播英国人工智能安全研究所最近测试发现,近期开放权重模型在网络安全任务上只落后封闭前沿大约四到七个月,过去二〇二五年的差距是六到十个月。这说明能力正在追近,但研究只覆盖网络安全,不能直接外推到生物领域。3:59主播声明还提到一项 Anthropic 参与的模块化训练研究,尝试把双重用途能力放进可以开关的模块。研究者明确说,这仍是初步工作,还没有应用到生产模型,所以它是研究方向,不是现成的治理方案。4:19主播这篇声明划出的界线,不是开放权重和封闭权重,而是三种行为:谁拿到了先进计算资源,谁在工业规模提取别人的能力,以及模型发布前是否经过安全测试。这个框架比一律放行或一律禁止更有针对性,也更难执行。4:40主播如果危险能力已经随权重公开,之后的测试、撤回和责任追究由谁承担,仍没有答案。阿莫代伊给出的是 Anthropic 的政策立场,不是已经生效的全球规则。接下来要观察的,是政府和行业能否把芯片管制、蒸馏认定和模型测试做成可验证、可执行的制度。