1 paper · 1 filter
Tanmoy Chakraborty, Ayan Sengupta, Suparna Bhattacharya +7
Large language models (LLMs) frequently achieve impressive scores on standardized benchmarks, yet accuracy alone offers a limited view of their capabilities. Evaluating open-source…