Hassabis 成立 DeepMind Institute:五篇关于 AGI 的文章,一句「不代表 Google 官方立场」

Hassabis 成立 DeepMind Institute:五篇关于 AGI 的文章,一句「不代表 Google 官方立场」

Demis Hassabis 与 Shane Legg 宣布成立 DeepMind Institute:一个设在 Google DeepMind 内部的跨学科发表平台,首发五篇文章,其中四篇出自 Google 体系、一篇出自剑桥学者,而每篇文章下面都注明这些文章不代表 Google 的官方立场;这一期把它与 Amodei、Altman、LeCun 各自要交出的东西以及现行监管的实际状态放在一起对照。

北京时间 9 月 16 日 22 时 29 分,Google DeepMind 联合创始人兼主席、Alphabet 首席科学家 Demis Hassabis 在 X 上宣布成立 DeepMind Institute(下称 DMI)。它是设在 Google DeepMind 内部的一个跨学科研究与发表平台,上线时挂着五篇文章,每篇文章下面都写着同一句话:这些文章只是「讨论的起点」,反映作者本人的想法与研究,不应被读作 Google 的官方立场。 12
三分钟前,DeepMind 联合创始人兼首席 AGI 科学家 Shane Legg 先发了同一件事;20 秒前,Google DeepMind 官方账号又转发了 Legg 那条。34
Loading content card…
发布前一小时,Hassabis 还发过一条帖,谈的是皇家艺术学会(RSA)的 2026 年阿尔伯特奖章——奖章的事在 9 月 11 日:RSA 当天刊出新闻稿,官方账号当天发帖;他在帖里复述了那场活动上的一句话:「I think the answers need to come from the arts and the humanities.」(我认为答案需要来自艺术与人文。)567
他这两处的说法,在 DMI 的成立文里合成了一句:「塑造这个新时代的现实,责任整体上属于整个社会,包括艺术与人文,以及政府。」39
先把这间研究所的位置说清楚:它交付的是论证和场地;能决定前沿模型能不能发布的几个关口,都装在别处。

01 这间研究所长什么样

站点上只有六个网址:首页,和五篇文章。8
成立文列出了三位董事:Shane Legg(联合创始人兼首席 AGI 科学家)、James Manyika(Google 研究、实验室、技术与社会的总裁)、Demis Hassabis(Google DeepMind 联合创始人兼主席、Alphabet 首席科学家)。责任编辑同样是 Shane Legg,联系方式是一个 Google 邮箱:dmi-editor@google.com39
它给自己要回答的问题是这样写的:
How do we safely build and govern AGI systems and the communities of agents they will form? Which institutions and policies will society need to adapt to AGI - or reimagine altogether?
「我们如何安全地构建与治理 AGI 系统,以及它们将形成的智能体社群?社会需要让哪些制度与政策去适应 AGI,或者重新设想它们?」39
在同一篇里,它还预先给这批作者定了基调:
They will not always agree, and they will likely change their minds, as more data and information comes to light at the fast-moving frontier.
「他们不会总是一致;在快速变化的前沿带来更多数据与信息时,他们很可能改变想法。」39
每篇文章下面写着的是这样一段:
The DMI is a platform, started by researchers from Google and Google DeepMind, to publish and discuss creative, deeply informed ideas about a world with AGI. DMI pieces are intended to serve as conversation starters, reflecting the author's ideas and research, and should not be read as Google's official view.
「DMI 是一个由来自 Google 与 Google DeepMind 的研究者发起的平台,用来发表与讨论关于 AGI 世界的、有创见且有充分依据的想法。DMI 的文章意在充当讨论的起点,反映作者本人的想法与研究,不应被读作 Google 的官方立场。」39
五篇文章的作者名单,能直接说明「跨学科」眼下指什么:
篇目作者作者身份
Introducing the DeepMind InstituteShane Legg、James Manyika、Demis HassabisGoogle DeepMind 与 Google 管理层2
The case for reasoning transparencyRohin Shah、Anca DraganGoogle DeepMind:AGI 安全与对齐总监;AI 安全与行为副总裁9
Economic Policy for AGIJulian Jacobs、Alex ImasGoogle DeepMind:经济学家与研究科学家;AGI 经济学总监10
Principles for a New UtopianismStephen Cave剑桥大学 Leverhulme 未来智能中心学术主任、技术与人文学会联席主任11
A Framework for Frontier AI and the Dawning of a New AgeDemis HassabisGoogle DeepMind 联合创始人兼主席、Alphabet 首席科学家12
四篇出自 Google 体系,一篇出自剑桥。
写可推理透明度那一篇的两位作者,同时是《前沿安全框架》(Frontier Safety Framework)的署名制定者——那是 Google DeepMind 对外承诺前沿模型安全的那套文件。 Rohin Shah 是 2025 年 2 月那一版的制定者之一,Anca Dragan 是 2025 年 9 月那一版的署名作者。1314

02 头五篇里,已经有三样能对账的东西

第一样是一篇关于思维链(chain of thought,模型写下来给自己读的推理步骤)的文章。
它提出三个动作:测量思维链的透明度、保留让推理可读的架构、审计训练中给模型加过的奖励。40
它还给出一个能算的提议,叫「不透明串行深度」(opaque serial depth,指模型在不借用可读推理步骤的前提下能连续做多长的计算):如果把未来模型的这一深度限制在当前模型的 10 倍以内,按今天的范式与架构,整体算力还能再扩大 1000 倍以上。40
这一篇还引用了两份 Google 之外的文件。OpenAI 在最新模型 GPT-6 Astra 的系统卡(模型发布时随附的安全与能力说明)里自述,相比此前模型出现了「思维链可监控性的显著下降」;英国 AI 安全研究院的外部评估则称,它「在单次前向计算内推理的能力大幅提升,并且能够控制其思维链的内容」。40
第二样是经济政策那篇。它用一个由 51 个「经济学家」人格组成的 AI 评审团,给常见讨论里的 11 项政策打分,四个维度分别是福利与韧性、能动性与发言权、可行性与效率,以及在不同 AGI 经济情景下的耐久性。41
在 0 到 100 分的评分里,能动性这一项的合成分是:「普遍基本资本」(Universal Basic Capital)拿到 76.3,失业保险 43.7。配套的一篇工作论文挂在预印本平台 SSRN 上。41
第三样来自剑桥学者 Stephen Cave,题为《新乌托邦主义的原则》。他给出三条原则——中期主义、谦逊、多元——并主张把普遍基本服务(UBS)放在普遍基本收入(UBI)之前。开篇那句话就是全文立场:
Averting apocalypse is not enough: we need visions of utopia too.
「只避免灾难是不够的:我们也需要关于乌托邦的想象。」42
这三样东西的共同点,是都能被反驳:有量级、有引用、有方法。 能被反驳,是这批文章和一份新闻稿的差别所在。

03 最该看的,是 Hassabis 自己七月写的那一篇

名单上的第五篇,作者是 Hassabis 本人,标题《A Framework for Frontier AI and the Dawning of a New Age》。
它的原始版本 2026 年 7 月 14 日发在他自己的订阅平台 Substack 上,标题一字不差。两版之间能确认的差别在文末头衔:从「Google DeepMind 与 Isomorphic Labs 联合创始人兼 CEO」,改成了「Google DeepMind 联合创始人兼主席、Alphabet 首席科学家」。1543
日期口径要留意。DMI 页面给这篇文章标的发布时间是 2026 年 9 月 4 日,而它的原始发表日是 7 月 14 日;同一批页面的修改时间集中在北京时间 9 月 16 日 21 时 49 分至 21 时 50 分之间,也就是宣布之前约四十分钟。4344
它主张的是一套具体机构:在美国设立一个受联邦监督的标准机构,形态是公私合作或行业自律组织,董事会里有独立技术专家和开源代表,经费主要来自行业;模型按该机构定期更新的基准判定是否属于「前沿级」;初期由实验室自愿在发布前最多 30 天把模型交给机构评审,等到评审协议被证明有效,就转为在美国市场部署前必须通过;基准按季度更新,并培育第三方审计生态;特殊情况下,这个机构可以协调前沿实验室一起放慢开发。43
要建立外部关卡的那份方案,和承载它的这个平台,现在都在 Google DeepMind 内部;而每篇文章下面写着,这些文章不代表 Google 的官方立场。 3943

04 另外几家要对方交出来的东西

话发在哪这一步要对方交出什么眼下到了哪一步
Yann LeCun9 月 16 日在 X 的帖更好的模型本身,护栏写进目标函数;他称「Pacing」(为安全而放慢节奏)这个词起反作用16答案在模型本身,没有提交环节
Dario Amodei(Anthropic 首席执行官)9 月 12 日在个人网站的长文常驻嵌入式第三方评估者:办公室工位、门禁卡、公司电脑,权限与内部风险评估团队大体相当;以及不受编辑控制、只有狭窄删改权的公开发表权17Anthropic 单方面承诺这一步;其政策文件里写明的外部评审,是让长期利益信托(Long-Term Benefit Trust)要求对风险报告做评审、并批准评审人选1819
Sam Altman(OpenAI 首席执行官)9 月 12 日与 9 月 14 日在 X 的帖在预期显著提升能力的前沿强化学习训练开跑之前写出明确的安全案例;接纳拥有员工级访问权的独立评估者2021到 9 月 16 日,那份安全案例没有公开
Demis Hassabis7 月 14 日的一篇文章,现在挂在 DMI 上美国主导的标准机构,初期自愿送审最多 30 天,之后转为市场准入要求12停在文章阶段
Shane Legg(DMI 责任编辑)与公告同日刊出的《金融时报》采访能力不能跑在安全前面;对 Amodei 的方案,他的评价是「方向上有意思」「值得考虑」,但要细究怎么落地22采访
《金融时报》给那篇采访配的副题是:「Shane Legg launches new institute to explore deployment of artificial general intelligence, amid growing calls for industry slowdown」(Shane Legg 成立新机构研究通用人工智能的部署,眼下业界要求放慢的呼声正在升高)。45
这份表里有两处值得单独看一眼。
一处是「员工级权限」这四个字。Amodei 要的是让常驻的第三方评估者到自己的办公室上班,Altman 承诺的也是同一件事,Hassabis 的方案要的则是一道外部关卡。434647
另一处是谁在回应。到北京时间 23 时 30 分,Amodei 的 X 上最新一条仍是 9 月 12 日那篇长文的宣告帖。48
当天在发帖的是 DMI 自己这一圈人。经济那篇的作者 Alex Imas 把新机构描述成一个「致力于就 AGI 引发的社会与经济问题做跨学科、以证据为基础的辩论的论坛」;23 DMI 成员 Atoosa Kasirzadeh 发帖时写了「作为其中一员」。24

05 发布前的关卡,现在装在谁手里

Hassabis 那篇文章要的是一道外部关卡。看一下现在真实存在的东西,就能知道这道关卡的空位有多大。
美国总统 2026 年 6 月 2 日签署的第 14409 号行政命令,6 月 5 日在《联邦公报》刊出,第 3(c) 条写着:
Nothing in this section shall be construed to authorize the creation of a mandatory governmental licensing, preclearance, or permitting requirement for the development, publication, release, or distribution of new AI models, including frontier models.
「本节不得被解释为授权对包括前沿模型在内的新 AI 模型的开发、发表、发布或分发,设立强制性的政府许可、预审或批准要求。」第 3(b) 条建立的是一套自愿框架:开发者可以请政府判定自己的模型是否属于「受覆盖的前沿模型」,也可以自愿在发布给其他可信伙伴之前最多 30 天让政府看到它。25
美国国家标准与技术研究院下设的 AI 标准与创新中心(CAISI),官方职责页写的两件事是「与私营 AI 开发者及评估方建立自愿协议」和「牵头做非机密评估」。26
欧盟针对通用人工智能(GPAI)模型的义务条款自 2025 年 8 月适用,2026 年 8 月 2 日起由欧盟 AI Office 负责执法:它可以索要技术文档、评估模型、要求整改、开罚单。同一份官方页面上还写着,欧盟委员会将启动一项扩充模型评估能力的招标,预计 2027 年才能运作。27
加州与纽约走的是披露与报告这条路。加州 2025 年 9 月 29 日签署的 SB 53 要求公开发布前沿 AI 框架、向州紧急事务办公室报告潜在重大安全事件,并设举报人保护与民事罚则;28 纽约 2025 年 12 月 19 日签署的 RAISE Act 要求大型开发者公布安全协议,并在认定事故发生后的 72 小时内报告,还在金融服务厅下设一个监督办公室。29 加州在 2026 年 9 月 9 日又签了 SB 813 与 AB 1405,建立独立验证组织评估合规、并给 AI 审计师做州级登记与独立性标准。30
这几处要的都是披露、报告、评估与审计资质;发布前的关卡,眼下只装在公司自己的机器上。
Anthropic 的 Responsible Scaling Policy 当前版本 3.4、2026 年 7 月 8 日生效,机制是能力阈值:模型跨过某条线,就触发更强的保障与论证义务。18 OpenAI 的安全与安保委员会,官方对它的授权写得很直接:就重大模型发布听取安全评估简报,与全体董事会共同行使监督权,「包括在安全疑虑解决之前延迟发布的权力」。31 Google DeepMind 的一侧则是前沿安全框架,最新一版 3.1 在 2026 年 4 月 17 日发布,加入了「被追踪能力等级」;这一版的署名作者里,就有写可推理透明度那篇的 Anca Dragan。49
Hassabis 那篇文章要做的,是把其中一道关卡搬到公司之外;承载它的,是 DMI 上的一篇文章。

06 上一次办这种机构,是 2017 年

DeepMind 在 2017 年办过一次同类机构,当时叫 DeepMind Ethics & Society。
2017 年 10 月 3 日,DeepMind 发布《Why we launched DeepMind Ethics & Society》,署名是 Sean Legassick 与 Verity Harding,宣布成立一个叫 Ethics & Society 的研究单元,双重目标是「帮技术人把伦理付诸实践」,以及「帮社会预判并引导 AI 影响」。32
那一次的组成方式与这次不同:它请了六位校外顾问。2018 年底的官方页面存档列出六位:牛津大学的 Nick Bostrom、剑桥大学的 Diane Coyle、普林斯顿大学的 Edward Felten、曾任《联合国气候变化框架公约》执行秘书的 Christiana Figueres、当时在麦肯锡全球研究院的 James Manyika,以及哥伦比亚大学的 Jeffrey Sachs。页面把这些顾问的职能写成「提供监督、批评性反馈与指导」。33
名单上有一位现在坐在 DMI 的董事席上:James Manyika。
这个单元今天在 Google DeepMind 的官网上已经找不到自己的位置,而官方始终没有就它的结束发过声明。能核到的是它留下的痕迹:各栏目子页面在 2019 年底被合并成一个总页面,原来的网址现在指向 DeepMind 首页,这个单元自己的 Medium 账号最后一篇停在 2018 年 3 月 14 日,DeepMind 2019 年文章里「DeepMind Ethics & Society」这个链接,现在指向责任与安全页。345051
Google 层面另有一次更短的记录。2019 年 3 月 26 日,Google 宣布成立先进技术外部咨询委员会(ATEAC),列出八名成员;4 月 4 日,官方在同一页加了编辑注:
It's become clear that in the current environment, ATEAC can't function as we wanted. So we're ending the council and going back to the drawing board.
「在当前环境下,ATEAC 显然无法按我们期望的方式运作。因此我们将结束该委员会,回到白板前重新设计。」35
从成立到结束,九天。
2017 年的模式是请一批外部人当顾问;这一次是自己人写署名文章、一位校外学者投稿,再加一句「不代表 Google 的官方立场」。

07 决定权散落在另外几处

在这一年里,Google 还动过一次与这件事相邻的组织。
据 Quartz 在 2026 年 8 月 27 日引述《华尔街日报》的报道,Google 把大约 90 人的 AI 责任团队从 Google DeepMind 移进公司的全球事务部门,也就是负责游说与公共政策的那个部门,迁移在 9 月初完成。这个团队的工作包括评估模型在化学、生物、放射与核风险上的表现,以及研究聊天机器人对用户行为与心理的影响;该报道称,团队里有人担心调岗会削弱独立性、减少与 Gemini 研发人员的接触。责任事务副总裁 Helen King 在内部邮件中回复说,团队在负责任 AI 的前沿议题上的聚焦不变,对外发表研究「continues to be supported and important」(继续得到支持,而且很重要)。36
Google 自己在 2026 年 2 月发布的责任 AI 进展报告里,还写着另一层结构:模型发布由 Google DeepMind 的 Launch Review 论坛审批;在这类发布评审之外,还有一个「AGI 未来委员会」(AGI Futures Council),成员来自 Google 高级管理层与 Alphabet 董事会,就 AGI 的长期机会、风险与影响向董事会与管理层提供建议。37
两件事放在一起看:2026 年,Google 把 AI 责任职能移出实验室、放得更靠近公司的政策部门;而关于 AGI 该如何被治理的讨论,被放进了实验室——每篇文章下面都注明,这些文章不代表公司的立场。
DMI 的经济政策文章,与 Google 另一条研究线挨得很近。Google 在 DMI 宣布的前一天(9 月 15 日)发布了「AI 与经济 ATLAS」——一个研究 AI 如何改变经济的长期项目,负责方是首席经济学家办公室与技术与社会团队;38 而 DMI 的第一批文章里,也有一篇在算 AGI 经济政策。两件事各有自己的发布方,公开材料里还没有说明它们之间怎么分工。

08 接下来看什么

有四个可以逐条验收的点。
第一,DMI 会不会发一篇批评 Google DeepMind 自己做法的文章。 头五篇里,唯一对外开火的是可推理透明度那篇,它批评的对象是 OpenAI 的 GPT-6 Astra。40
第二,它文章里的具体主张会不会进入 Google DeepMind 自己的文件。「不透明串行深度」的测量、思维链透明度的评估,能不能写进前沿安全框架的下一版或 Gemini 的模型报告,是这批文章从观点变成公司制度的第一个可查之处。4049
第三,标准机构方案会不会离开文章阶段。 判断的标尺很简单:这份方案有没有变成一份提交给政府、CAISI 或立法者的文件,或者有没有出现为它出钱的机构。4352
第四,第二批文章的分量与作者构成。 头五篇里有一篇来自 Google 之外;校外学者投稿会不会延续,是「跨学科」这句话能不能持续成立的地方。4253
Hassabis 在宣布前一个多小时谈的是艺术与人文,随后交给读者的是一间研究所、一个 Google 邮箱和五篇文章。DeepMind 上一次办同类机构时请来六位校外顾问,2017 年那张顾问名单上的 Manyika,现在是第一批文章的共同作者。

References

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
    DeepMind Institute 站点地图

    institute.deepmind.com

  9. 9
  10. 10
    Economic Policy for AGI\

    institute.deepmind.com

  11. 11
    Principles for a New Utopianism\

    institute.deepmind.com

  12. 12
  13. 13
  14. 14
  15. 15
  16. 16
  17. 17
  18. 18
  19. 19
  20. 20
  21. 21
  22. 22
  23. 23
  24. 24
  25. 25
  26. 26
  27. 27
    AI Act — Shaping Europe's digital future

    digital-strategy.ec.europa.eu

  28. 28
  29. 29
  30. 30
  31. 31
  32. 32
  33. 33
  34. 34
  35. 35
  36. 36
  37. 37
  38. 38
  39. 39
    2
  40. 40
    9
  41. 41
    10
  42. 42
    11
  43. 43
    12
  44. 44
    15
  45. 45
    21
  46. 46
    17
  47. 47
    20
  48. 48
    18
  49. 49
    14
  50. 50
    32
  51. 51
    33
  52. 52
    25
  53. 53
    8

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content