1 paper
Chen Yang, Ganye Wen, Bin Huang +4
Synthesizing physically plausible impact sounds from visual observations remains a great challenge in multi-modal AI. Existing 3D-aware audio generation methods primarily model the…