2 papers
cs.LG2025
Set Valued Predictions For Robust Domain Generalization
Ron Tsibulsky, Daniel Nevo, Uri Shalit
Despite the impressive advancements in modern machine learning, achieving robustness in Domain Generalization (DG) tasks remains a significant challenge. In DG, models are expected…
cs.CL2025
BIG-Bench Extra Hard
Mehran Kazemi, Bahare Fatemi, Hritik Bansal +17
Large language models (LLMs) are increasingly deployed in everyday applications, demanding robust general reasoning capabilities and diverse reasoning skillset. However, current LL…