1 paper
Yiyuan Zhang, Handong Li, Jing Liu +1
We propose to build omni-modal intelligence, which is capable of understanding any modality and learning universal representations. In specific, we propose a scalable pretraining p…