1 paper · 1 filter
Xuannan Liu, Xing Cui, Peipei Li +6
The rapid evolution of multimodal foundation models has led to significant advancements in cross-modal understanding and generation across diverse modalities, including text, image…