2 papers
cs.CV2026
Beyond Static Costs: Learning-Dynamics Aware Loss Functions for Long-Tailed Classification
Varad Shinde, Nikhil Kumar Shrey, Magesh Rajasekaran +5
Deep learning models in computer vision face significant challenges when trained on long-tailed datasets, where a few majority classes dominate while many minority classes are seve…
cs.CL2025
Referring Expressions as a Lens into Spatial Language Grounding in Vision-Language Models
Akshar Tumu, Varad Shinde, Parisa Kordjamshidi
Spatial Reasoning is an important component of human cognition and is an area in which the latest Vision-language models (VLMs) show signs of difficulty. The current analysis works…