3 papers
cs.RO2026
AppleVLM: End-to-end Autonomous Driving with Advanced Perception and Planning-Enhanced Vision-Language Models
Yuxuan Han, Kunyuan Wu, Qianyi Shao +6
End-to-end autonomous driving has emerged as a promising paradigm integrating perception, decision-making, and control within a unified learning framework. Recently, Vision-Languag…
cs.CV2025
Group Evidence Matters: Tiling-based Semantic Gating for Dense Object Detection
Yilun Xiao
Dense small objects in UAV imagery are often missed due to long-range viewpoints, occlusion, and clutter[cite: 5]. This paper presents a detector-agnostic post-processing framework…
cs.CV2025
UDA4Inst: Unsupervised Domain Adaptation for Instance Segmentation
Yachan Guo, Yi Xiao, Danna Xue +2
Instance segmentation is crucial for autonomous driving, but is hindered by the lack of annotated real-world data due to expensive labeling costs. Unsupervised Domain Adaptation (U…