1 paper
Annalisa Szymanski, Simret Araya Gebreegziabher, Oghenemaro Anuyah +2
Large Language Models (LLMs) are increasingly utilized for domain-specific tasks, yet evaluating their outputs remains challenging. A common strategy is to apply evaluation criteri…