GPT-6 Astra 的“看不见推理”:能力跃迁,还是监控退化?

9 月 1 日至 7 日,OpenAI 先公布 GPT-6 Astra 达到 Preparedness Framework 的 Critical 网络安全能力阈值,9 月 3 日正式发布。争议落在 opaque recurrence:模型可能用更少、甚至没有语言 token 完成更深的计算,外部因此更难审计它怎样得出结论。123
Jakub Pachocki 把可监控性变难视为能力进步的伴随结果;Ryan Greenblatt 要求先弄清递归深度能否继续放大;Buck Shlegeris 则担心放大后会让 CoT 监控失效。三张卡只保留各自的身份、中文摘译和理由,读者可以把分歧放在同一张桌面上比较。45

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

Comments