1 paper
Haonan Zheng, Xinyang Deng, Wen Jiang +1
With Vision-Language Pre-training (VLP) models demonstrating powerful multimodal interaction capabilities, the application scenarios of neural networks are no longer confined to un…