1 paper
Maxim Divilkovskiy, Vitaly Malygin, Sergey Zlobin +6
Autoregressive Language Models instantiate a factorized likelihood over token sequences, yet their strictly sequential decoding process imposes an intrinsic lower bound on inferenc…