1 paper
Evren Ayberk Munis, Deniz Yılmaz, Arianna Muti +1
Large language models are widely used across domains, yet there are concerns about their factual reliability and biases. Factual knowledge probing offers a systematic means to eval…