2 papers
cs.CV2026
EditSleuth: A Dataset of Grounded Reasoning Chains for Image-Edit Forensics
Van-Loc Nguyen, AprilPyone MaungMaung, Minh-Triet Tran +1
Forensic analysis of AI-edited images requires more than binary real-versus-fake prediction: a useful system should localize the edit, identify its semantic type, and ground its de…
cs.CV2026
Beyond Standard Benchmarks: A Systematic Audit of Vision-Language Model's Robustness to Natural Semantic Variation Across Diverse Tasks
Jia Chengyu, AprilPyone MaungMaung, Huy H. Nguyen +2
Recent advances in vision-language models (VLMs) trained on web-scale image-text pairs have enabled impressive zero-shot transfer across a diverse range of visual tasks. However, c…