Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
P2DNav: Panorama-to-Downview Reasoning for Zero-shot Vision-and-Language Navigation
Kai Sheng, Liuyi Wang, Haojie Dai +5
Vision-and-language navigation (VLN) requires an embodied agent to ground natural-language instructions into executable navigation actions in unseen environments. Existing zero-sho…
cs.CV2024
Edge-Cloud Collaborative Satellite Image Analysis for Efficient Man-Made Structure Recognition
Kaicheng Sheng, Junxiao Xue, Hui Zhang
The increasing availability of high-resolution satellite imagery has created immense opportunities for various applications. However, processing and analyzing such vast amounts of…