3 papers
cs.LG2026
OPIUM: Mitigating Steering Externalities and Over-Refusal via Dual Objective Latent Optimization
Kavin Aravindan, Arihant Rastogi, Aadi Prasad +4
Activation steering provides a lightweight mechanism for controlling large language models at inference time, but steering vectors can have unintended externalities: utility vector…
cs.CL2025
Adapting Multilingual Models to Code-Mixed Tasks via Model Merging
Prashant Kodali, Vaishnavi Shivkumar, Swarang Joshi +3
We study model merging as a practical alternative to conventional adaptation strategies for code-mixed NLP. Starting from a multilingual base model, we: (i) perform continued pre-t…
cs.LG2025
MetaGMT: Improving Actionable Interpretability of Graph Multilinear Networks via Meta-Learning Filtration
Rishabh Bhattacharya, Hari Shankar, Vaishnavi Shivkumar +1
The growing adoption of Graph Neural Networks (GNNs) in high-stakes domains like healthcare and finance demands reliable explanations of their decision-making processes. While inhe…