works on

From the 1 of 5 linked papers with an AI index.

activity
20242026
collaborators
Showing cs.CVShow all

5 papers · 1 filter

cs.CV2026

MED-DSLC: Multi-Expert-Domain Classification via Domain Supervision and Logit Calibration

Zheng Zeng, Deepak Sridhar, Nuno Vasconcelos

The paper introduces MED-DSLC, a lightweight method that restores global logit comparability across independently fine‑tuned vision‑language model experts by using domain supervisi…

cs.CV2026

Video Reasoning without Training

Deepak Sridhar, Kartikeya Bhardwaj, Jeya Pradha Jeyaraj +3

Video reasoning using Large Multimodal Models (LMMs) relies on costly reinforcement learning (RL) and verbose chain-of-thought, resulting in substantial computational overhead duri…

cs.CV2025

SCHEME: Scalable Channel Mixer for Vision Transformers

Deepak Sridhar, Yunsheng Li, Nuno Vasconcelos

Vision Transformers have achieved impressive performance in many vision tasks. While the token mixer or attention block has been studied in great detail, much less research has bee…

cs.CV2024

Adapting Diffusion Models for Improved Prompt Compliance and Controllable Image Synthesis

Deepak Sridhar, Abhishek Peri, Rohith Rachala +1

Recent advances in generative modeling with diffusion processes (DPs) enabled breakthroughs in image synthesis. Despite impressive image quality, these models have various prompt c…

cs.CV2024

Prompt Sliders for Fine-Grained Control, Editing and Erasing of Concepts in Diffusion Models

Deepak Sridhar, Nuno Vasconcelos

Diffusion models have recently surpassed GANs in image synthesis and editing, offering superior image quality and diversity. However, achieving precise control over attributes in g…