2 papers
cs.LG2025
Stabilizing Multi-Attack Adversarial Training via Bandit Optimization
Rui Wang, Zeming Wei, Xiyue Zhang +1
Deep Neural Networks (DNNs) remain vulnerable to diverse adversarial perturbations, motivating multi-attack adversarial training (AT) for improved robustness. However, existing met…
cs.AI2025
Revisiting Hallucination Detection with Effective Rank-based Uncertainty
Rui Wang, Zeming Wei, Guanzhang Yue +1
Detecting hallucinations in large language models (LLMs) remains a fundamental challenge for their trustworthy deployment. Going beyond basic uncertainty-driven hallucination detec…