3 papers
cs.SD2026
SonicCaps: Large-Scale Diverse and Fine-Grained Captioning for Improved Audio-Retrieval
Zineb Lahrichi, Marc Ferras, Gaël Richard +1
Recent advances in audio-language modeling have been driven by large-scale audio captioning datasets. However, existing datasets remain limited by low semantic diversity, generic d…
cs.SD2026
S-PRESSO: Ultra Low Bitrate Sound Effect Compression With Diffusion Autoencoders And Offline Quantization
Zineb Lahrichi, Gaëtan Hadjeres, Gaël Richard +1
Neural audio compression models have recently achieved extreme compression rates, enabling efficient latent generative modeling. Conversely, latent generative models have been appl…
cs.SD2025
QINCODEC: Neural Audio Compression with Implicit Neural Codebooks
Zineb Lahrichi, Gaëtan Hadjeres, Gael Richard +1
Neural audio codecs, neural networks which compress a waveform into discrete tokens, play a crucial role in the recent development of audio generative models. State-of-the-art code…