1 paper · 1 filter
Prannaya Gupta, Le Qi Yau, Hao Han Low +8
WalledEval is a comprehensive AI safety testing toolkit designed to evaluate large language models (LLMs). It accommodates a diverse range of models, including both open-weight and…