Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
How Reasoning Influences Intersectional Biases in Vision Language Models
Adit Desai, Sudipta Roy, Mohna Chakraborty
Vision Language Models (VLMs) are increasingly deployed across downstream tasks, yet their training data often encode social biases that surface in outputs. Unlike humans, who inte…
cs.CV2025
Dual-Stage Value-Guided Inference with Margin-Based Reward Adjustment for Fast and Faithful VLM Captioning
Ankan Deria, Adinath Madhavrao Dukre, Feilong Tang +5
Despite significant advances in inference-time search for vision-language models (VLMs), existing approaches remain both computationally expensive and prone to unpenalized, low-con…