4 citations · 4 across the 3 of their papers we have counts for
1 paper · 1 filter
Mohamed Dhouib, Davide Buscaldi, Sonia Vanier +1
Visual Language Models require substantial computational resources for inference due to the additional input tokens needed to represent visual information. However, these visual to…