1 paper
Jannis Bulian, Mike S. Schäfer, Afra Amini +8
As Large Language Models (LLMs) rise in popularity, it is necessary to assess their capability in critically relevant domains. We present a comprehensive evaluation framework, grou…