Showing cs.CVShow all
3 papers · 1 filter
cs.CV2026
Unlocking Zero-Shot Geospatial Reasoning via Indirect Rewards
Chenhui Xu, Fuxun Yu, Michael J. Bianco +15
Training robust reasoning vision-language models (VLMs) in rare domains (such as geospatial) is fundamentally constrained by supervision scarcity. While raw geospatial imagery is a…
cs.CV2026
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
Jiajie Li, Chenhui Xu, Meihuan Liu +1
Conventional fine-tuning on domain-specific datasets can inadvertently alter a model's pretrained multimodal priors, leading to reduced generalization. To address this, we propose…
cs.CV2025
Recognize Any Surgical Object: Unleashing the Power of Weakly-Supervised Data
Jiajie Li, Brian R Quaranto, Chenhui Xu +5
We present RASO, a foundation model designed to Recognize Any Surgical Object, offering robust open-set recognition capabilities across a broad range of surgical procedures and obj…