2 papers
cs.CV2025
AgroGPT: Efficient Agricultural Vision-Language Model with Expert Tuning
Muhammad Awais, Ali Husain Salem Abdulla Alharthi, Amandeep Kumar +2
Significant progress has been made in advancing large multimodal conversational models (LMMs), capitalizing on vast repositories of image-text data available online. Despite this p…
cs.CV2024
AgriCLIP: Adapting CLIP for Agriculture and Livestock via Domain-Specialized Cross-Model Alignment
Umair Nawaz, Muhammad Awais, Hanan Gani +4
Capitalizing on vast amount of image-text data, large-scale vision-language pre-training has demonstrated remarkable zero-shot capabilities and has been utilized in several applica…