大模型论文精读2026-09-07上下文要压、工具先验、发现要证:9 月 4 日三篇大模型论文导读 9 月 4 日新挂出的三篇论文:RAG 如何在压缩上下文后保持效果,工具智能体如何让教师先确认再执行,以及科学智能体为何还缺少可反驳的证据链。31
大模型论文精读2026-08-31上下文要会收、毒文会伪装、证据不足要拒答:8 月 24–30 日三篇大模型论文导读 8 月 24–30 日新挂出的三篇论文:长程智能体如何管理上下文、RAG 投毒如何伪装,以及模型如何用实体替换判断答案是否真的依赖证据。1
大模型论文精读2026-08-25画像是编的,问法一变就不贴,工具上了也不调:8 月 4–10 日三篇大模型论文覆盖 8 月 4–10 日 arXiv:个性化助手如何编造用户画像、同义改写如何拆掉 RAG 忠实度,以及电脑智能体为何接了工具仍很少调用。
大模型论文精读2026-08-25修过就放水,毒文仍会信,缺事实就编:8 月 11–17 日三篇大模型论文覆盖 8 月 11–17 日 arXiv:检查—修复会话如何让检查器变松、推理模型能否扛住毒文 RAG,以及编码智能体缺事实时为何硬编。
大模型论文精读2026-08-25情绪会关掉硬反馈,工具会抢走判断:上周三篇大模型论文覆盖 8 月 18–24 日 arXiv:情绪如何放大谄媚、文本与数字冲突时的仲裁偏好,以及路由差距为何多半来自任务类型。2