2 papers
cs.CV2026
SpatiaLab: Can Vision-Language Models Perform Spatial Reasoning in the Wild?
Azmine Toushik Wasi, Wahid Faisal, Abdur Rahman +12
Spatial reasoning is a fundamental aspect of human cognition, yet it remains a major challenge for contemporary vision-language models (VLMs). Prior work largely relied on syntheti…
cs.HC2025
Seeing Isn't Believing: Addressing the Societal Impact of Deepfakes in Low-Tech Environments
Azmine Toushik Wasi, Rahatun Nesa Priti, Mahir Absar Khan +2
Deepfakes, AI-generated multimedia content that mimics real media, are becoming increasingly prevalent, posing significant risks to political stability, social trust, and economic…