3 papers
cs.AI2026
How Vision Becomes Language: A Layer-wise Information-Theoretic Analysis of Multimodal Reasoning
Hongxuan Wu, Yukun Zhang, Xueqing Zhou
When a multimodal Transformer answers a visual question, is the prediction driven by visual evidence, linguistic reasoning, or genuinely fused cross-modal computation -- and how do…
cs.HC2025
Clinician-Directed Large Language Model Software Generation for Therapeutic Interventions in Physical Rehabilitation
Edward Kim, Yuri Cho, Jose Eduardo E. Lima +20
Digital health interventions increasingly deliver home exercise programs via sensor-equipped devices such as smartphones, enabling remote monitoring of adherence and performance. H…
cs.AI2025
MC-GNNAS-Dock: Multi-criteria GNN-based Algorithm Selection for Molecular Docking
Siyuan Cao, Hongxuan Wu, Jiabao Brad Wang +2
Molecular docking is a core tool in drug discovery for predicting ligand-target interactions. Despite the availability of diverse search-based and machine learning approaches, no s…