collaborators

5 papers

cs.CV2026

BLM-SGAN: Bidirectional Language Modeling for Semantic-Spatial Text-to-Image Generation

Ahmed Abdelmoneim Mazrou, Haidy Maher El-Amir, Ali Hamdi

Despite the success of image generation from text descriptions, it still faces challenges that are difficult to overcome in domains such as natural language processing (NLP) and co…

cs.CL2024

RIRO: Reshaping Inputs, Refining Outputs Unlocking the Potential of Large Language Models in Data-Scarce Contexts

Ali Hamdi, Hozaifa Kassab, Mohamed Bahaa +1

Large language models (LLMs) have significantly advanced natural language processing, excelling in areas like text generation, summarization, and question-answering. Despite their…

cs.CV2024

RHRSegNet: Relighting High-Resolution Night-Time Semantic Segmentation

Sarah Elmahdy, Rodaina Hebishy, Ali Hamdi

Night time semantic segmentation is a crucial task in computer vision, focusing on accurately classifying and segmenting objects in low-light conditions. Unlike daytime techniques,…

cs.CV2024

MMIS: Multimodal Dataset for Interior Scene Visual Generation and Recognition

Hozaifa Kassab, Ahmed Mahmoud, Mohamed Bahaa +2

We introduce MMIS, a novel dataset designed to advance MultiModal Interior Scene generation and recognition. MMIS consists of nearly 160,000 images. Each image within the dataset i…

cs.CV2024

GCF: Graph Convolutional Networks for Facial Expression Recognition

Hozaifa Kassab, Mohamed Bahaa, Ali Hamdi

Facial Expression Recognition (FER) is vital for understanding interpersonal communication. However, existing classification methods often face challenges such as vulnerability to…