1 paper
Emil Laftchiev, Prachi Agrawal, Moe Kayali +7
Large language models (LLMs) achieve state-of-the-art generative ranking quality, but the ranking they produce must be decoded, and autoregressive decoding spends one sequential fo…