1 paper
Dian Yu, Qingchuan Zhou, Bingkun Huang +2
Current Vision-Language-Action (VLA) models rely primarily on RGB perception, preventing them from capturing modalities such as thermal signals that are imperceptible to convention…