1 paper
Zihan Li, Wei Sun, Jing Hu +3
While large language-image pre-trained models like CLIP offer powerful generic features for image clustering, existing methods typically freeze the encoder. This creates a fundamen…