1 paper · 1 filter
Ambrish Rawat, Jessica He, Subhabrata Majumdar +6
Generative AI assessments remain dominated by frontier capability benchmarks that often fail to capture whether systems can be sustainably deployed, adapted, and trusted in locally…