2 papers
cs.CV2025
AgroGPT: Efficient Agricultural Vision-Language Model with Expert Tuning
Muhammad Awais, Ali Husain Salem Abdulla Alharthi, Amandeep Kumar +2
Significant progress has been made in advancing large multimodal conversational models (LMMs), capitalizing on vast repositories of image-text data available online. Despite this p…
cs.CV2024
CAMEL-Bench: A Comprehensive Arabic LMM Benchmark
Sara Ghaboura, Ahmed Heakl, Omkar Thawakar +7
Recent years have witnessed a significant interest in developing large multimodal models (LMMs) capable of performing various visual reasoning and understanding tasks. This has led…