本期精读 arXiv:2607.08393「Towards Mechanistically Understanding Why Memorized Knowledge Fails to Generalize in Large Language Model Finetuning」。节目会讲清三个问题:微调模型为什么可能先「记住」新事实、却迟迟不能把它用于多跳推理;self-patching 如何定位知识在层间的可用位置;以及 knowledge–circuit misalignment 为什么把知识更新失败解释成一种内部路由问题。