量子位把这篇报道拆成两条线:一条是唐杰对 GLM 的升级预告,另一条是已经公开的 IndexCache 论文。
- 预告是什么:唐杰在评论区回应「史诗级 plus」。这句话是升级线索,不等于新模型已经发布,也没有给出正式版本号。1
- 论文在解决什么:IndexCache 面向稀疏注意力的长上下文推理,通过跨层复用索引器结果,减少相邻层重复计算。论文已被 COLM 接收。2
- 为什么和 GLM 有关:报道将这套思路与 GLM-5.2 中的 IndexShare 联系起来,并提到百万 Token 上下文与计算量下降等结果;这些是报道与论文语境中的技术线索,不是对下一代 GLM 规格的官方确认。1
想继续往下看,可读IndexCache 论文与GLM-5.2 官方介绍。



Comments
Sign in to comment.