1 paper · 1 filter
Chen Chen, Lai Wei
Large language model (LLM) scaling is hitting a wall. Widening models yields diminishing returns, and extending context length does not improve fundamental expressivity. In contras…