1 paper
Mohammad Anas Jawad, Cornelia Caragea
Existing calibration methods for Large Language Models (LLMs) often overlook a critical dimension of trustworthiness: a model's behavioral robustness to irrelevant or misleading in…