1 paper · 1 filter
Zongyu Guo, Jiajun He, Zhaoyang Jia +6
Modern visual generative models acquire rich visual knowledge through large-scale training, yet existing visual representations (such as pixels, latents, or tokens) remain external…