1 paper
Jipeng Liu, Haichao Shi, Siyu Xing +2
While Vision-Language Models (VLMs) like CLIP have emerged as a dominant paradigm for generalizable deepfake detection, a representational disconnect remains: their semantic-centri…