2 papers
cs.CV2024
Enhancing Multimodal Large Language Models Complex Reason via Similarity Computation
Xiaofeng Zhang, Fanshuo Zeng, Yihao Quan +2
Multimodal large language models have experienced rapid growth, and numerous different models have emerged. The interpretability of LVLMs remains an under-explored area. Especially…
cs.CV2023
Building Lane-Level Maps from Aerial Images
Jiawei Yao, Xiaochao Pan, Tong Wu +1
Detecting lane lines from sensors is becoming an increasingly significant part of autonomous driving systems. However, less development has been made on high-definition lane-level…