1 paper
Gyeongje Cho, Yeonkyoung So, Sangmin Lee +1
Tokenization directly affects the inference efficiency of large language models, since fragmented tokenization increases sequence length and generation cost. Although longer, multi…