2 papers
cs.MM2026
FillGauss: Fine-Grained Filling-Aware Impact Sound Generation for 3D Gaussian Splatting
Chen Yang, Ganye Wen, Bin Huang +4
Synthesizing physically plausible impact sounds from visual observations remains a great challenge in multi-modal AI. Existing 3D-aware audio generation methods primarily model the…
cs.CV2026
Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models
Enyi Shi, Pengyang Shao, Yanxin Zhang +5
The robust safety of Vision-Language Large Models (VLLMs) against joint multilingual and multimodal threats remains severely underexplored. Current benchmarks typically isolate the…