1 paper · 1 filter
Gabriel Stanovsky, Renana Keydar, Gadi Perl +1
The performance of AI models on safety benchmarks does not indicate their real-world performance after deployment. This opaqueness of AI models impedes existing regulatory framewor…