1 paper
Chonghe Hao, Yue Sun, Jian Zhang +4
Efficient long-sequence modeling remains a central challenge for large language models, as self-attention scales quadratically with sequence length. Mamba offers a linear-time alte…