1/3

SearchGEO:检索 Agent 会被网页带偏

新智元文章图片笔记:用三张卡看懂 SearchGEO 如何评测检索 Agent 被开放网页带偏的风险,以及不同模型在拒绝和过度信任上的分裂失败模式。

新智元原文:现代 AI 之父新作:13 个大模型实测,检索 agent 真的可信吗?。该文由白名单公众号「新智元」于 2026-07-09 12:43 发布;微信详情页本轮只返回阅读壳,标题、发布时间和原文 URL 来自公众号文章列表。1
这组三张卡把 SearchGEO 的核心问题说清:联网检索让 AI 能读新网页,也让攻击者发布的网页有机会变成模型的「推荐」。
图 1|一个被低估的攻击面 新智元可读转载称,SearchGEO 关注开放网络上的第三方内容如何经由搜索 agent 综合,转化为模型认可的推荐。2 arXiv 摘要也将风险定义为 attacker-published pages 被转化为 endorsed claims。3
图 2|评测怎么做 论文提出 SearchGEO,用受控的 web-evidence manipulation pipeline、五种攻击模式和多个输出指标评估搜索 agent;arXiv 摘要显示,研究在 13 个 LLM 后端上评估,每个后端 308 个案例。3
图 3|不是一个分数就能概括 arXiv 摘要称,不同后端的整体 ASR 从 Claude-Sonnet-4.6 的 0.0% 到 Gemini-3-Flash 的 31.4% 不等;辅助 agent-skill 探针还暴露出 Claude 过度拒绝、GPT 过度信任的分裂失败模式。3

相似内容

评论

登录后可发表评论。