1 paper
Giovanni Bonetta, Matteo Merler, Davide Zago +2
Vision-Language Models (VLMs) provide useful priors for interactive decision-making, but using them directly as policies is expensive and brittle: they must be queried at every ste…