12 citations · 13 across the 4 of their papers we have counts for
1 paper · 1 filter
Samuel Cestola, Tianxiang Xia, Zheng Weiyan +2
Retrieval-augmented generation improves large language models' accuracy by adding relevant retrieved text to the prompt. Chunk level caching (CLC) accelerates inference by precompu…