6 papers
Speech-Guided Multimodal Learning for Vocal Tract Segmentation in Real-Time MRI
Daiqi Liu, Lukas Mulzer, Md Hasan +11
Segmenting vocal tract articulators in real-time MRI (rtMRI) is a challenging dynamic image segmentation problem characterized by low contrast, rapid motion, and limited spatial re…
VocSegMRI: Multimodal Learning for Precise Vocal Tract Segmentation in Real-time MRI
Daiqi Liu, Johannes Enk, Maureen Stone +7
Accurate segmentation of articulatory structures in real-time MRI (rtMRI) remains challenging, as existing methods rely primarily on visual cues and overlook complementary informat…
Cross-Modal Fine-Tuning of 3D Convolutional Foundation Models for ADHD Classification with Low-Rank Adaptation
Jyun-Ping Kao, Shinyeong Rho, Shahar Lazarev +5
Early diagnosis of attention-deficit/hyperactivity disorder (ADHD) in children plays a crucial role in improving outcomes in education and mental health. Diagnosing ADHD using neur…
Speech Audio Generation from dynamic MRI via a Knowledge Enhanced Conditional Variational Autoencoder
Yaxuan Li, Han Jiang, Yifei Ma +3
Dynamic Magnetic Resonance Imaging (MRI) of the vocal tract has become an increasingly adopted imaging modality for speech motor studies. Beyond image signals, systematic data loss…
Brightness-Invariant Tracking Estimation in Tagged MRI
Zhangxing Bian, Shuwen Wei, Xiao Liang +10
Magnetic resonance (MR) tagging is an imaging technique for noninvasively tracking tissue motion in vivo by creating a visible pattern of magnetization saturation (tags) that defor…
A Speech-to-Video Synthesis Approach Using Spatio-Temporal Diffusion for Vocal Tract MRI
Paula Andrea Pérez-Toro, Tomás Arias-Vergara, Fangxu Xing +9
Understanding the relationship between vocal tract motion during speech and the resulting acoustic signal is crucial for aided clinical assessment and developing personalized treat…