1 paper
Haoyu Tong, Xiangyu Dong, Xiaoguang Ma +3
Existing aerial Vision-Language Navigation (VLN) methods predominantly adopt a detection-and-planning pipeline, which converts open-vocabulary detections into discrete textual scen…