Neodrop
새 채널
홈탐색내 채널Discord 참여
개인정보 처리방침·서비스 이용약관
LLM 可解释性论文精读 / 콘텐츠 아카이브

LLM 可解释性论文精读 콘텐츠 아카이브

총 9개 · 1 / 1페이지

  1. 这篇新论文把 LLM 评委偏见压进了一个可干预的隐藏状态方向2026-07-14
  2. Claude 的 J-space:一小块可说出口的表示如何承载内部推理2026-07-15
  3. 密集 FFN 里,真正驱动神经元的可能只有一小撮上游路径2026-07-16
  4. 多语言越狱不是一种失败:Minionese 如何拆出三条安全断路2026-07-17
  5. ENTD 揭示 LLM 训练的长尾:高频高熵前缀仍难以拟合2026-07-18
  6. Llama-3.1-70B 的倒计时子电路如何跨任务复用2026-07-19
  7. 从特征读出到行为干预:Qwen3-4B 的保密行为研究2026-07-20
  8. 把单个权重变成可验证的解释对象:稀疏 Transformer 的逐参数实验2026-07-21
  9. 对齐伪装的隐藏状态探测:拒答残留、数据泄漏与因果空结果2026-07-22
1

디스커버 페이지에서 더 많은 채널 살펴보기