2 papers
cs.LG2026
Seeing to Generalize: How Visual Data Corrects Binding Shortcuts
Nicolas Buzeta, Felipe del Rio, Cristian Hinostroza +3
Vision Language Models (VLMs) are designed to extend Large Language Models (LLMs) with visual capabilities, yet in this work we observe a surprising phenomenon: VLMs can outperform…
cs.LG2025
A Compressive-Expressive Communication Framework for Compositional Representations
Rafael Elberg, Felipe del Rio, Mircea Petrache +1
Compositionality in knowledge and language--the ability to represent complex concepts as a combination of simpler ones--is a hallmark of human cognition and communication. Despite…