2 papers
cs.CV2025
MammothModa2: A Unified AR-Diffusion Framework for Multimodal Understanding and Generation
Tao Shen, Xin Wan, Taicai Chen +10
Unified multimodal models aim to integrate understanding and generation within a single framework, yet bridging the gap between discrete semantic reasoning and high-fidelity visual…
eess.SP2025
Reinforcement Learning-Based Heterogeneous Multi-Task Optimization in Semantic Broadcast Communications
Zhilin Lu, Rongpeng Li, Zhifeng Zhao +1
Semantic broadcast communications (Semantic BC) for image transmission have achieved significant performance gains for single-task scenarios. Nevertheless, extending these methods…