2 papers
cs.CV2025
Geo3DVQA: Evaluating Vision-Language Models for 3D Geospatial Reasoning from Aerial Imagery
Mai Tsujimoto, Junjue Wang, Weihao Xuan +1
Three-dimensional geospatial analysis is critical for applications in urban planning, climate adaptation, and environmental assessment. However, current methodologies depend on cos…
cs.CV2025
Concept-based Explainable Data Mining with VLM for 3D Detection
Mai Tsujimoto
Rare-object detection remains a challenging task in autonomous driving systems, particularly when relying solely on point cloud data. Although Vision-Language Models (VLMs) exhibit…