3 papers
cs.CV2025
Words or Vision: Do Vision-Language Models Have Blind Faith in Text?
Ailin Deng, Tri Cao, Zhirui Chen +1
Vision-Language Models (VLMs) excel in integrating visual and textual information for vision-centric tasks, but their handling of inconsistencies between modalities is underexplore…
cs.LG2024
Are Anomaly Scores Telling the Whole Story? A Benchmark for Multilevel Anomaly Detection
Tri Cao, Minh-Huy Trinh, Ailin Deng +4
Anomaly detection (AD) is a machine learning task that identifies anomalies by learning patterns from normal training data. In many real-world scenarios, anomalies vary in severity…
cs.CV2024
ID: Identity-Preserving-yet-Diversified Diffusion Models for Synthetic Face Recognition
Shen Li, Jianqing Xu, Jiaying Wu +7
Synthetic face recognition (SFR) aims to generate synthetic face datasets that mimic the distribution of real face data, which allows for training face recognition models in a priv…