1 paper
Xiabao Wu, Wentao Liu, Yongchao Liu +1
Retrieval-Augmented Generation (RAG) effectively mitigates hallucinations in Large Language Models (LLMs) but suffers from prohibitive Time-To-First-Token (TTFT) latency in long-co…