activity
20242026
collaborators
Showing cs.SDShow all

5 papers · 1 filter

cs.SD2026

Local Multimodal Music Alignment from Global Supervision

Irmak Bukey, Zachary Novack, Jongmin Jung +2

Understanding music requires understanding localized relationships across data modalities, e.g., how time in performance audio maps onto position in a score image. Yet supervision…

cs.SD2026

Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation

HaeJun Yoo, Hao-Wen Dong, Jongmin Jung +1

Representing symbolic music with compound tokens, where each token consists of several different sub-tokens representing a distinct musical feature or attribute, offers the advanta…

cs.SD2025

Unified Cross-modal Translation of Score Images, Symbolic Music, and Performance Audio

Jongmin Jung, Dongmin Kim, Sihun Lee +5

Music exists in various modalities, such as score images, symbolic scores, MIDI, and audio. Translations between each modality are established as core tasks of music information re…

cs.SD2025

LAV: Audio-Driven Dynamic Visual Generation with Neural Compression and StyleGAN2

Jongmin Jung, Dasaem Jeong

This paper introduces LAV (Latent Audio-Visual), a system that integrates EnCodec's neural audio compression with StyleGAN2's generative capabilities to produce visually dynamic ou…

cs.SD2024

MusicGen-Chord: Advancing Music Generation through Chord Progressions and Interactive Web-UI

Jongmin Jung, Andreas Jansson, Dasaem Jeong

MusicGen is a music generation language model (LM) that can be conditioned on textual descriptions and melodic features. We introduce MusicGen-Chord, which extends this capability…