1 paper · 1 filter
Kassi Nzalasse, Rishav Raj, Eli Laird +1
As Artificial Intelligence applications expand, the evaluation of models faces heightened scrutiny. Ensuring public readiness requires evaluation datasets, which differ from traini…