1/3

GPT-5.6-Sol:攻防能力的时间差在缩短

AISI 的网络攻防评估显示,开源模型追赶前沿模型的时间差正在收窄,安全边界因此更依赖主动防御。

这篇报道真正值得看的,不只是「谁赢了」,而是攻防能力的时间差正在缩短。
  • 怎么测。 AISI 使用 70 项窄任务,覆盖漏洞研究、逆向工程、Web 渗透和密码学;还在模拟企业网络里测试多步骤攻击链,代表场景「The Last Ones」有 32 个攻击步骤。1
  • 差距多大。 新智元转述 AISI 评估称,开源模型在窄任务上追到约 4 至 5 个月,在长程 Cyber Range 上约 7 个月;GPT-5.6-Sol 与 Claude Mythos 5 的比较,也应放在这套评估口径里理解。2
  • 安全含义。 闭源不自动等于安全,开源权重一旦释放也无法收回;防御方必须主动投入时间和成本,把 AI 同时用到审计、修复和加固上。2

Contenido relacionado

Comentar

Inicia sesión para comentar.