4 papers
AVSCap: Orchestrating Audio-Visual Synergy for Omni-modal Video Captioning
Yanghai Wang, Jiahao Wang, Jiafu Tang +9
Omni-modal video captioning is not merely combining visual captioning with audio transcription: a useful caption must describe how visual actions, speech, music, and sound effects…
Enerzyme: A Framework for Efficient Training of Reactive Neural Network Potentials for Enzyme Catalysis with Application to Methyltransferases
Weiliang Luo, Heather J. Kulik
Quantum mechanical (QM) cluster models provide an effective framework for mechanistic studies of enzymatic reactions but remain computationally demanding. Neural network potentials…
Beyond the Training Domain: Robust Generative Transition State Models for Unseen Chemistry
Samir Darouich, Jacob W. Toney, Weiliang Luo +3
Transition states (TSs) govern the rates and outcomes of chemical reactions, making their accurate prediction a central challenge in computational chemistry. Although recent machin…
Enhancing Materials Discovery with Valence Constrained Design in Generative Modeling
Mouyang Cheng, Weiliang Luo, Hao Tang +6
Diffusion-based deep generative models have emerged as powerful tools for inverse materials design. Yet, many existing approaches overlook essential chemical constraints such as ox…