1 paper
Andrés Villa, Juan León Alcázar, Motasem Alfarra +3
Large language models and vision transformers have demonstrated impressive zero-shot capabilities, enabling significant transferability in downstream tasks. The fusion of these mod…