2 papers
cs.AR2026
Sequence-Aware Split Heuristic to Mitigate SM Underutilization in FlashAttention-3 Low-Head-Count Decoding
Martà Llopart Font, Javier Hernando, Cristina España-Bonet
The standard FlashAttention-3 heuristic exhibits a GPU occupancy bottleneck in low-head-count decoding configurations because it disables sequence splitting based on sequence lengt…
eess.AS2024
Enhancing Crowdsourced Audio for Text-to-Speech Models
José Giraldo, Martà Llopart-Font, Alex Peiró-Lilja +3
High-quality audio data is a critical prerequisite for training robust text-to-speech models, which often limits the use of opportunistic or crowdsourced datasets. This paper prese…