4 papers
Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference
Shuaifan Jin, Zhibo Wang, Qiyuan Wang +5
Collaborative inference deploys Large Vision-Language Models (LVLMs) by partitioning computation between edge devices and the cloud. While withholding raw inputs supposedly ensures…
LiDAR Teach, Radar Repeat: Robust Cross-Modal Navigation in Degenerate and Varying Environments
Renxiang Xiao, Yichen Chen, Yuanfan Zhang +5
Long-term autonomy requires robust navigation in environments subject to dynamic and static changes, as well as adverse weather conditions. Teach-and-Repeat (T\&R) navigation offer…
VLM-Augmented Degradation Modeling for Image Restoration Under Adverse Weather Conditions
Qianyi Shao, Yuanfan Zhang, Renxiang Xiao +1
Reliable visual perception under adverse weather conditions, such as rain, haze, snow, or a mixture of them, is desirable yet challenging for autonomous driving and outdoor robots.…
Rad-GS: Radar-Vision Integration for 3D Gaussian Splatting SLAM in Outdoor Environments
Renxiang Xiao, Wei Liu, Yuanfan Zhang +4
We present Rad-GS, a 4D radar-camera SLAM system designed for kilometer-scale outdoor environments, utilizing 3D Gaussian as a differentiable spatial representation. Rad-GS combine…