1 paper
Kassi Nzalasse, Rishav Raj, Eli Laird +1
As Artificial Intelligence applications expand, the evaluation of models faces heightened scrutiny. Ensuring public readiness requires evaluation datasets, which differ from traini…