1 paper · 1 filter
Geunbin Yu
As large language models from diverse providers converge toward comparable benchmark performance, the traditional paradigm of selecting a single best model per task yields diminish…