4 papers
Scene Understanding Enabled Semantic Communication with Open Channel Coding
Zhe Xiang, Fei Yu, Quan Deng +2
As communication systems transition from symbol transmission to conveying meaningful information, sixth-generation (6G) networks emphasize semantic communication. This approach pri…
Enhanced Multimodal RAG-LLM for Accurate Visual Question Answering
Junxiao Xue, Quan Deng, Fei Yu +3
Multimodal large language models (MLLMs), such as GPT-4o, Gemini, LLaVA, and Flamingo, have made significant progress in integrating visual and textual modalities, excelling in tas…
Pilot-guided Multimodal Semantic Communication for Audio-Visual Event Localization
Fei Yu, Zhe Xiang, Nan Che +4
Multimodal semantic communication, which integrates various data modalities such as text, images, and audio, significantly enhances communication efficiency and reliability. It has…
Multimodal Trustworthy Semantic Communication for Audio-Visual Event Localization
Yuandi Li, Zhe Xiang, Fei Yu +4
The exponential growth in wireless data traffic, driven by the proliferation of mobile devices and smart applications, poses significant challenges for modern communication systems…