3 papers
cs.CV2026
The Cartesian Shortcut: Re-evaluate Vision Reasoning in Polar Coordinate Space
Xia Hu, Zhenrui Yue, Brian Potetz +4
As current Multimodal Large Language Models rapidly saturate canonical visual reasoning benchmarks, a key question emerges: do these strong scores genuinely reflect robust visual u…
cs.AI2026
Agile Deliberation: Concept Deliberation for Subjective Visual Classification
Leijie Wang, Otilia Stretcu, Wei Qiao +7
From content moderation to content curation, applications requiring vision classifiers for visual concepts are rapidly expanding. Existing human-in-the-loop approaches typically as…
cs.SI2026
S2Vec: Self-Supervised Geospatial Embeddings for the Built Environment
Shushman Choudhury, Elad Aharoni, Chandrakumari Suvarna +4
Scalable general-purpose representations of the built environment are crucial for geospatial artificial intelligence applications. This paper introduces S2Vec, a novel self-supervi…