1 paper · 1 filter
Yutian Jiang, Ruijie Li, Sisuo Lyu +4
Open-world geo-localization requires models to reason over ambiguous visual cues through multi-step reasoning and external knowledge grounding. While recent large vision-language m…