0:56

OpenAI、Anthropic、Google API漏洞让弱模型解出隐藏推理

研究人员发现,OpenAI、Anthropic 和 Google 的部分模型接口会把加密后的推理块交给客户端,并允许它随下一轮请求返回。论文显示,这些加密块曾可跨用户、跨会话,甚至在同一厂商的不同模型之间复用;把强模型生成的块转给防护较弱的模型,后者可能吐出原本隐藏的推理。1
研究团队从公开日志中重建了 315,320 个推理块,识别出 704 条隐私数据,其中 64 条只存在于加密推理内。2 相关厂商已限制主要复用路径,但历史公开日志不会因此自动消失。3
开发团队应停止记录加密推理字段,清查公开仓库,并轮换可能暴露的密钥。个人和机构在上传敏感资料前,也应先判断是否确有必要,并遵守所在机构的数据规则。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel