1 paper
Bo Hu, Han Yuan, Vlad Pandelea +3
The rapid advancement of large language models (LLMs) has sparked widespread adoption across diverse applications, making robust evaluation frameworks crucial for assessing their p…