7 citations · 7 across the 3 of their papers we have counts for
3 papers
cs.CV2025
Novel Category Discovery with X-Agent Attention for Open-Vocabulary Semantic Segmentation
Jiahao Li, Yang Lu, Yachao Zhang +3
Open-vocabulary semantic segmentation (OVSS) conducts pixel-level classification via text-driven alignment, where the domain discrepancy between base category training and open-voc…
cs.CV2025
SeqVLM: Proposal-Guided Multi-View Sequences Reasoning via VLM for Zero-Shot 3D Visual Grounding
Jiawen Lin, Shiran Bian, Yihang Zhu +4
3D Visual Grounding (3DVG) aims to localize objects in 3D scenes using natural language descriptions. Although supervised methods achieve higher accuracy in constrained settings, z…
cs.SD2024★ 7 cited
Exploring Multi-Modal Control in Music-Driven Dance Generation
Ronghui Li, Yuqin Dai, Yachao Zhang +4
Existing music-driven 3D dance generation methods mainly concentrate on high-quality dance generation, but lack sufficient control during the generation process. To address these i…