1 paper · 1 filter
Akanksha Chuchra, Shukesh Reddy, Sudeepta Mishra +2
While Vision-Language Models (VLMs) and Multimodal Large Language Models (MLLMs) have shown strong generalisation in detecting image and video deepfakes, their use for audio deepfa…