1 paper
Yuan Gao, Dengyuan Hua, Mattia Piccinini +4
Vision Language Models (VLMs) bridge visual perception and linguistic reasoning. In Autonomous Driving (AD), this synergy has enabled Vision Language Action (VLA) models, which tra…