LinearAttention系列解读(一):Transformers Are RNNs学习分享本文详细介绍了经典的linear attention提出的motivation和算法原理。并对其局限性做了讨论2026-7-23 大模型 linear_transformer
LinearAttention系列解读(二):DeltaNet技术剖析学习分享本文相对系统讨论了linear attention中的deltanet变体。本文着重介绍了该方法的核心motivation和insight:将固定state看成一个从key到value的fast-weight model,并根据prediction error对已有映射做增量修正。2026-8-11 大模型 linear_transformer