5 papers · 1 filter
Local Multimodal Music Alignment from Global Supervision
Irmak Bukey, Zachary Novack, Jongmin Jung +2
Understanding music requires understanding localized relationships across data modalities, e.g., how time in performance audio maps onto position in a score image. Yet supervision…
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
HaeJun Yoo, Hao-Wen Dong, Jongmin Jung +1
Representing symbolic music with compound tokens, where each token consists of several different sub-tokens representing a distinct musical feature or attribute, offers the advanta…
Unified Cross-modal Translation of Score Images, Symbolic Music, and Performance Audio
Jongmin Jung, Dongmin Kim, Sihun Lee +5
Music exists in various modalities, such as score images, symbolic scores, MIDI, and audio. Translations between each modality are established as core tasks of music information re…
LAV: Audio-Driven Dynamic Visual Generation with Neural Compression and StyleGAN2
Jongmin Jung, Dasaem Jeong
This paper introduces LAV (Latent Audio-Visual), a system that integrates EnCodec's neural audio compression with StyleGAN2's generative capabilities to produce visually dynamic ou…
MusicGen-Chord: Advancing Music Generation through Chord Progressions and Interactive Web-UI
Jongmin Jung, Andreas Jansson, Dasaem Jeong
MusicGen is a music generation language model (LM) that can be conditioned on textual descriptions and melodic features. We introduce MusicGen-Chord, which extends this capability…