

OpenAI、Anthropic、Google API漏洞让弱模型解出隐藏推理
研究人员发现,OpenAI、Anthropic 和 Google 的部分模型接口会把加密后的推理块交给客户端,并允许它随下一轮请求返回。论文显示,这些加密块曾可跨用户、跨会话,甚至在同一厂商的不同模型之间复用;把强模型生成的块转给防护较弱的模型,后者可能吐出原本隐藏的推理。1
开发团队应停止记录加密推理字段,清查公开仓库,并轮换可能暴露的密钥。个人和机构在上传敏感资料前,也应先判断是否确有必要,并遵守所在机构的数据规则。
References
- 1
- 2Stolen Thoughts 项目页
stolen-thoughts.com
- 3
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
