2 papers
cs.LG2025
Distributional Surgery for Language Model Activations
Bao Nguyen, Binh Nguyen, Duy Nguyen +1
Language models, while capable of generating remarkably coherent and seemingly accurate text, can occasionally produce undesirable content, including harmful or toxic outputs. In t…
cs.LG2025
Coverage-Validity-Aware Algorithmic Recourse
Ngoc Bui, Duy Nguyen, Man-Chung Yue +1
Algorithmic recourse emerges as a prominent technique to promote the explainability, transparency, and ethics of machine learning models. Existing algorithmic recourse approaches o…