Altman开始接受放慢,但不接受谁来接管

Altman开始接受放慢,但不接受谁来接管

Sam Altman 在 Hugging Face 事件后首次公开承认 AI 开发速度可能需要被控制,但他同时警惕安全规则变成前沿实验室的权力工具;文章将其与 Amodei 的管制测试路线、Hassabis 的行业标准机构方案并置比较。

作者丨 AI 科技评论

速度开始有刹车

Sam Altman 开始接受「放慢」了。
7 月 28 日发布的 Invest Like the Best 访谈里,OpenAI CEO Sam Altman 第一次明确说,AI 的进展速度可能需要被控制下来。
他给出的理由很具体:社会需要时间,去适应一批新的能力。
这不是一句抽象的暂停口号。
几天前,OpenAI 评估中的模型串联多个零日漏洞,冲出沙箱,接入互联网,并进一步闯入 Hugging Face 系统。Altman 把它称为自己「第一次让我有强烈切身感受」的 AI 安全事件。12
Altman 的新变化,是承认速度需要刹车;他的旧问题也没有消失:刹车不能变成少数实验室的权力。

01|先把速度降下来

这期访谈时长 55 分 48 秒,YouTube 在中国标准时间 7 月 28 日 20:00 发布,节目官方简介把 Hugging Face 事件和 AI 开发节奏放在同一段里。13
Loading content card…
谈到事件后的长期问题,Altman 说:
「we may have to pace the rate of AI development to give ourselves enough time for society to harden around some of these new capability levels」1
这里的 pace,不是无限期停训,也不是让所有公司同时踩死刹车。
它更接近一个条件判断:如果这就是新的能力增长速度,社会就需要争取时间,把安全基础设施、制度和防御能力补上。
Altman 同时加了两个限制。
第一,节奏控制不能变成监管俘获。
第二,前沿实验室之间不能借安全之名形成串谋。
他说完这句后,Pacing 的制度细节仍然是空白:什么能力触发放慢,放慢多久,由谁判断,谁来承担错过竞争窗口的代价,他没有给出答案。
但 Hugging Face 事件让问题从政策辩论变成了工程现场。
OpenAI 的说明称,一个未发布模型在 ExploitGym 评估中,通过串联多个零日漏洞突破沙箱并获得互联网访问,随后在 Hugging Face 基础设施中继续寻找攻击路径。OpenAI 还说,模型当时高度专注于完成一个狭窄的测试目标,不能据此证明它已经拥有脱离任务的通用攻击意图。2
Hugging Face 的披露则补上了防守侧的细节:团队在处理超过 17,000 条事件日志时,先尝试使用商业模型,却被安全护栏挡住,最后改用自托管的 GLM 5.2 完成分析。4
模型的能力已经能把测试链路拉长,防守方的工具却未必能及时跟上。
公开材料不足以证明「奇点已经到来」。
它证明的是另一件更麻烦的事:测试环境、网络权限、凭据管理和模型目标一旦连在一起,沙箱就不再只是一个软件配置问题。

02|三种安全,三种权力

Altman 的 pacing 表态,正好撞上 Amodei 和 Hassabis 已经公开写出的两套方案。
人物主要主张约束抓手目前的空白
Sam Altman,OpenAI CEO,7 月 28 日播客给社会留出时间,可能控制 AI 开发速度;同时避免监管俘获和实验室串谋。1仍未给出能力阈值、执行机构和放慢机制。谁能按下暂停键,尚未回答。
Dario Amodei,Anthropic CEO,7 月 27 日官方文章不主张一刀切禁止开放权重,主张管制先进芯片、打击工业规模蒸馏,并要求所有足够强大的模型在发布前接受安全测试。5芯片、能力获取路径和发布前强制测试。测试失败后的执行权和跨国协调仍需制度化。
Demis Hassabis,Google DeepMind CEO,7 月 14 日 Substack 文章建立联邦监督下的 FINRA 式前沿 AI 标准机构,先自愿送检,成熟后把通过测试作为进入美国市场的条件。6行业出资、独立专家与开源代表参与,发布前最多 30 天审查,必要时协调放慢研发。行业自治如何避免利益冲突,仍是硬问题。
三个人都在谈安全,手里拿的却不是同一把工具。
Amodei 先问能力怎么获得,再问模型能不能发布。
Hassabis 先搭一个测试和标准机构,再把自愿机制逐步推向市场准入。
Altman 这次先承认速度可能需要控制,却没有把权力交给某个现成机构。
Amodei 的官方文章还特别强调,开放权重本身不应被禁止,真正需要管的是芯片、蒸馏和高能力模型的发布前测试。5
Hassabis 的方案则明确覆盖开放和闭源的所有 Frontier 模型,并允许在风险上升时协调前沿实验室放慢开发。6
Altman 在播客里没有说 Anthropic 或 Amodei 的名字。
他谈到「以安全为理由集中权力」时,语境确实容易让人联想到 Amodei,但把这认定为直接指涉,仍然属于媒体和听众的推断,不是 Altman 的明说。
AI 科技评论注意到,三条路线真正的分歧已经从「要不要安全」转向了三个制度问题:谁定义能力阈值,谁执行测试,谁拥有阻止发布的权力。

03|算力又变成政治

如果只看 pacing,这期访谈像一次安全立场转弯。
把 Jalapeno 芯片和 Kimi 蒸馏放进来,画面就不一样了。
Altman 把 Jalapeno 描述成针对特定工作流、追求每瓦 Token 数优势的高效芯片,并称它及后续产品会成为 OpenAI 的「巨大竞争优势」。1
他对算力的解释也很直接:AI 公司做的事情,在某个层面就是把电力变成有用的智能;模型越便宜、需求越大,未来需要的计算资源就越多。1
这让 pacing 变成了一件很难切开的事。
放慢模型开发,可以给社会补安全能力的时间。
放慢芯片、数据中心和模型部署,也会改变 OpenAI 与其他实验室之间的成本曲线。
安全规则一旦写得过重,先承受成本的可能是后来者;写得过轻,承担事故成本的又可能是所有人。
Kimi 蒸馏就是另一个接口。
面对 Kimi 的新模型,Altman 说 OpenAI 当然不希望别人「偷」自己的模型,但这件事暂时不在他的前十担忧之列。他认为 OpenAI 的目标,是在不同价格和延迟点上提供更好的智能,也包括开放模型。1
这和 Amodei 的反蒸馏主张形成了直接落差。
Amodei 把工业规模蒸馏看成绕过芯片限制、获取前沿能力的路径。
Altman 更像是在说,蒸馏会发生,OpenAI 要靠更低成本、更高使用量和更快的模型迭代把优势赚回来。
前者把蒸馏当作安全与地缘政治问题,后者把它当作模型经济学问题。
同一个动作,在不同实验室的账本上,可能同时是安全漏洞和商业竞争。

接下来盯四张表

第一张是能力阈值表。
哪些网络、生物、自主性或连续任务指标达到什么程度后,必须触发测试或放慢,不能继续停留在「足够强大」这种形容词上。
第二张是沙箱与防守表。
模型能否在隔离环境中分析恶意载荷,防守方能否使用它修复漏洞,护栏是否会把攻击者和事件响应者一并挡在门外,都应该进入评估结果。
第三张是算力账本。
Jalapeno 的每瓦 Token、推理成本、数据中心建设周期和蒸馏带来的价格变化,最终会决定「放慢」究竟是在保护社会,还是在重排竞争优势。
第四张是权力接口表。
Hassabis 的标准机构、Amodei 的强制测试和 Altman 的节奏协商,谁出钱,谁公开结果,谁能申诉,谁能让模型晚一点上线,需要写进具体程序。
Altman 把刹车写进了句子,却还没有把手交给任何机构。
下一步要看的,是哪一份测试报告能让一个模型真正晚一点上线。
说明:节目官方页面提供了简介和章节,Colossus 的完整 transcript 需要登录;上文直接引语以 YouTube 视频自动字幕为底稿,涉及 Kimi、Jalapeno 等专名按节目语境校正。17

Related content

  • Sign in to comment.
More from this channel