8 papers
OASIS: A Multilingual and Multimodal Dataset for Culturally Grounded Spoken Visual QA
Firoj Alam, Ali Ezzat Shahroor, Md. Arid Hasan +8
Large-scale multimodal models achieve strong results on tasks like Visual Question Answering (VQA), but they are often limited when queries require cultural and visual information,…
Once Correct, Still Wrong: Counterfactual Hallucination in Multilingual Vision-Language Models
Basel Mousi, Fahim Dalvi, Shammur Chowdhury +2
Vision-language models (VLMs) can achieve high accuracy while still accepting culturally plausible but visually incorrect interpretations. Existing hallucination benchmarks rarely…
Fanar 2.0: Arabic Generative AI Stack
FANAR TEAM, Ummar Abbas, Mohammad Shahmeer Ahmad +34
We present Fanar 2.0, the second generation of Qatar's Arabic-centric Generative AI platform. Sovereignty is a first-class design principle: every component, from data pipelines to…
An Exploration of Knowledge Editing for Arabic
Basel Mousi, Nadir Durrani, Fahim Dalvi
While Knowledge Editing (KE) has been widely explored in English, its behavior in morphologically rich languages like Arabic remains underexamined. In this work, we present the fir…
Editing Across Languages: A Survey of Multilingual Knowledge Editing
Nadir Durrani, Basel Mousi, Fahim Dalvi
While Knowledge Editing has been extensively studied in monolingual settings, it remains underexplored in multilingual contexts. This survey systematizes recent research on Multili…
From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models
Asım Ersoy, Basel Mousi, Shammur Chowdhury +3
The emergence of large language models (LLMs) has demonstrated that systems trained solely on text can acquire extensive world knowledge, develop reasoning capabilities, and intern…