2 papers
cs.CV2026
Gaslight, Gatekeep, V1-V3: Early Visual Cortex Alignment Shields Vision-Language Models from Sycophantic Manipulation
Arya Shah, Vaibhav Tripathi, Mayank Singh +1
Vision-language models are increasingly deployed in high-stakes settings, yet their susceptibility to sycophantic manipulation remains poorly understood, particularly in relation t…
cs.LG2026
GF-Score: Certified Class-Conditional Robustness Evaluation with Fairness Guarantees
Arya Shah, Kaveri Visavadiya, Manisha Padala
Adversarial robustness is essential for deploying neural networks in safety-critical applications, yet standard evaluation methods either require expensive adversarial attacks or r…