1 paper
Haun Leung, ZiNan Wang
Since the emergence of Vision Transformer (ViT), it has been widely used in generative language model and generative visual model. Especially in the current state-of-art open sourc…