1 paper
Hun Chang, Byunghee Cha, Jong Chul Ye
Recent studies have explored using pretrained Vision Foundation Models (VFMs) such as DINO for generative autoencoders, showing strong generative performance. Unfortunately, existi…