2 papers
cs.CL2025
PlanGPT-VL: Enhancing Urban Planning with Domain-Specific Vision-Language Models
He Zhu, Junyou Su, Minxin Chen +4
In the field of urban planning, existing Vision-Language Models (VLMs) frequently fail to effectively analyze and evaluate planning maps, despite the critical importance of these v…
cs.AI2025
Retrieval-augmented in-context learning for multimodal large language models in disease classification
Zaifu Zhan, Shuang Zhou, Xiaoshan Zhou +6
Objectives: We aim to dynamically retrieve informative demonstrations, enhancing in-context learning in multimodal large language models (MLLMs) for disease classification. Methods…