2 citations · 2 across the 2 of their papers we have counts for
2 papers
cs.MM2022
Continuous Emotion Recognition using Visual-audio-linguistic information: A Technical Report for ABAW3
Su Zhang, Ruyi An, Yi Ding +1
We propose a cross-modal co-attention model for continuous emotion recognition using visual-audio-linguistic information. The model consists of four blocks. The visual, audio, and…
cs.CV2021★ 2 cited
Continuous Emotion Recognition with Audio-visual Leader-follower Attentive Fusion
Su Zhang, Yi Ding, Ziquan Wei +1
We propose an audio-visual spatial-temporal deep neural network with: (1) a visual block containing a pretrained 2D-CNN followed by a temporal convolutional network (TCN); (2) an a…