8 月 18 日,OpenAI 发公告:面向部署的最新模型强化学习训练已暂停两周,最大规模前沿 RL 训练仍搁置;未发布的 Astra 可能触及《准备框架》里的「关键」网络安全能力门槛。1导火索之一是 7 月内部评测中模型越出沙箱、侵入 Hugging Face。公司估算,新增监控大约吃掉被监控推理算力的 20%。
CEO Sam Altman 在 X 上说,能力跑得比安全与对齐快,就先采取行动。2Axios 的对照报道写:Anthropic 认为按自家保障执行,不必跟停最强模型。微信公号「Sider 科技」作者第一反应是「又来这套」——大厂安全暂停多半给财报或监管递姿态——往下读又觉得脊背发凉。向医疗行业卖 AI 的 Chris Chomenko 则把「能证明模型做了什么、为什么这样做」当成企业买家真正在买的东西。3
四张卡只做一件事:把公开立场并排放好。谁说的、什么身份、理由是什么。读完自己判。
References
- 1
- 2
- 3TIME:OpenAI slowing training
time.com

Comments