1 paper
Yan Li, Tianyi Zhang, Zechuan Li +1
Transformer-based Large Language Models (LLMs) struggle with inputs exceeding their training context window due to positional out-of-distribution (O.O.D.) issues that disrupt atten…