4 papers · 1 filter
BLM-SGAN: Bidirectional Language Modeling for Semantic-Spatial Text-to-Image Generation
Ahmed Abdelmoneim Mazrou, Haidy Maher El-Amir, Ali Hamdi
Despite the success of image generation from text descriptions, it still faces challenges that are difficult to overcome in domains such as natural language processing (NLP) and co…
RHRSegNet: Relighting High-Resolution Night-Time Semantic Segmentation
Sarah Elmahdy, Rodaina Hebishy, Ali Hamdi
Night time semantic segmentation is a crucial task in computer vision, focusing on accurately classifying and segmenting objects in low-light conditions. Unlike daytime techniques,…
MMIS: Multimodal Dataset for Interior Scene Visual Generation and Recognition
Hozaifa Kassab, Ahmed Mahmoud, Mohamed Bahaa +2
We introduce MMIS, a novel dataset designed to advance MultiModal Interior Scene generation and recognition. MMIS consists of nearly 160,000 images. Each image within the dataset i…
GCF: Graph Convolutional Networks for Facial Expression Recognition
Hozaifa Kassab, Mohamed Bahaa, Ali Hamdi
Facial Expression Recognition (FER) is vital for understanding interpersonal communication. However, existing classification methods often face challenges such as vulnerability to…