2 papers
cs.SD2026
Multi-Task Transformer for Explainable Speech Deepfake Detection via Formant Modeling
Viola Negroni, Luca Cuccovillo, Paolo Bestagini +2
In this work, we introduce a multi-task transformer for speech deepfake detection, capable of predicting formant trajectories and voicing patterns over time, ultimately classifying…
cs.CV2024
Visual and audio scene classification for detecting discrepancies in video: a baseline method and experimental protocol
Konstantinos Apostolidis, Jakob Abesser, Luca Cuccovillo +1
This paper presents a baseline approach and an experimental protocol for a specific content verification problem: detecting discrepancies between the audio and video modalities in…