本期 4 条 8 月 19—20 日公开原话,沿着「模型会在哪里失手 → 能力差距如何显现 → 进展怎样被证据约束 → 权力如何被制度承接」递进。以下时间均为频道展示时区(GMT+8)。
01|先把失效点说清楚
The most serious pattern we found was a command meant to clean up temporary work that could instead delete the user files. This should obviously not happen.
「我们发现的最严重模式,是本来用于清理临时工作的命令,可能反而删除用户文件。这显然不应该发生。」
OpenAI Codex 负责人 Tibo 在 2026 年 8 月 19 日 09:47 发帖,公开说明 Codex 曾出现超出用户要求的破坏性操作报告。他写到,问题涉及临时目录清理命令误指向用户主目录;后续防护包括检查删除目标、强化高风险命令拦截、改进 Auto-review,以及用回放评测重现失败。这里的原话不是泛泛的「AI 有风险」,而是把一个 Agent 系统必须面对的失效模式具体化。1
Loading content card…
02|前沿不是一个统一的区域
There are AI applications that are equally inside the frontier for both Mistral and frontier models, but cyberdefense is definitely not one of them.
「有些 AI 应用里,Mistral 和前沿模型都同样处在前沿;但网络防御绝对不是其中之一。」
沃顿商学院教授 Ethan Mollick 在 2026 年 8 月 19 日 22:29 发帖,把「主权 AI」的讨论从国家标签拉回具体应用:不同模型可能在一些任务上都够用,但在网络防御这类前沿差距更明显的领域,落后模型会带来实质代价。他的表述是对应用差距的判断,不是对所有任务的统一排名。2
Loading content card…
03|把加速说成早期证据
Some early evidence that AI may actually be accelerating discoveries in the areas where you would expect to see AI acceleration happening first.
「一些早期证据显示,AI 可能确实正在加速那些最有理由首先出现 AI 加速的领域中的发现。」
Ethan Mollick 在 2026 年 8 月 20 日 00:53 转述一项由 Nate Rush 参与的分析,原帖列出的暂定观察是:网络安全发现出现明显加速,数学有一些加速,算法则尚无清晰加速。他保留了「Some early evidence」这个限定词,所以这条金句更适合被读作一个待检验的研究信号,而不是「AI 已经全面加速科学」的结论。34
Loading content card…
04|软件更便宜,编码更昂贵
Agents made software cheaper but made coding expensive.
「Agent 让软件更便宜,却让编码变得更昂贵。」
Replit 首席执行官 Amjad Masad 在 2026 年 8 月 19 日 22:12 转发 Replit Free Mode 的发布帖时写下这句判断。它把 AI 编程的收益与代价分开:软件产出的边际成本可能下降,但把需求说清楚、检查结果、修正错误和承担维护责任,可能成为更昂贵的部分。后半句「Today, together with @OpenAI, we’re changing this」是他对合作发布的说明,卡面只保留前面的独立判断。56
Loading content card…
References
- 1Tibo 的 Codex 安全更新
x.com
- 2Ethan Mollick 的 X 原帖
x.com
- 3Ethan Mollick 的 X 原帖
x.com
- 4被转述的分析原帖
x.com
- 5Amjad Masad 的 X 原帖
x.com
- 6Replit Free Mode 发布帖
x.com


Comments
Sign in to comment.