1 paper
Tahitoa Leygue, Astrid Sabourin, Christian Bolzmacher +3
State-of-the-art transformer models for Speech Emotion Recognition (SER) rely on temporal feature aggregation, yet advanced pooling methods remain underexplored. We systematically…