1 paper
Chen Shi, Jinrui Xu, Shaoshuai Shi +3
Pretrained foundation models have become an important basis for end-to-end autonomous driving. In contrast to vision-language models pretrained primarily on static image-text pairs…