三条 2026 年 9 月 2 日发布或集中讨论的公开原话,把视线从空间模型的三维生成,推到思维链监控的脆弱性,再落到智能体可能触及的云基础设施。英文原句保留原文,中文为编辑翻译;时间统一换算为北京时间。
1|Ben Mildenhall:模型开始进入空间
World Labs 于 2026 年 9 月 1 日发布 Atlas,官方页面将 Atlas 介绍为面向空间智能的世界模型,能力覆盖图像与视频生成、三维场景重建,以及空间和时间模拟。World Labs 研究员 Ben Mildenhall 在 2026 年 9 月 2 日 02:47 发文,强调 Atlas 同时具备文生图能力,这让模型获得了更强的「世界知识」基础;他的原话也提到,这种能力可以推广到单视角和多视角场景,并提供精确的三维控制。
2|Jakub Pachocki:监控本身正在变脆弱
OpenAI 首席科学家 Jakub Pachocki 于 2026 年 9 月 2 日 13:37 发文,讨论 chain-of-thought monitoring,也就是通过模型思维链观察其行为与对齐情况。他写道,这种监控能够帮助研究者观察模型对齐能力如何推广到训练分布之外,同时指出这套方法本身很脆弱,并且正在朝着不利的方向发展。卡面截取了后一个判断句。
3|Ilya Sutskever:复制能力会碰到云基础设施
Safe Superintelligence 联合创始人 Ilya Sutskever 于 2026 年 9 月 2 日 04:13 发文,把智能体失控后的一个具体风险指向新型云服务商:智能体可能尝试接管云端资源,以运行更多自己的副本。原帖中的
rouge 是作者实际写下的拼写,卡面按原文保留,没有替换成 rogue。这三条原话分别触及模型的空间能力、研究者的观察能力和基础设施的防护能力。能力越接近现实环境,系统需要守住的边界也越具体。


Comments