3 citations · 3 across the 3 of their papers we have counts for
4 papers · 1 filter
GRAMformer: Any-Order Modality Interactions via Volumetric Multimodal Cross-Attention
Giordano Cicchetti, Eleonora Grassucci, Danilo Comminiello
Transformer-based multimodal models rely on attention mechanisms to integrate information across heterogeneous modalities. Despite their success, existing multimodal attention form…
Closing the gap in multimodal medical representation alignment
Eleonora Grassucci, Giordano Cicchetti, Danilo Comminiello
In multimodal learning, CLIP has emerged as the de-facto approach for mapping different modalities into a shared latent space by bringing semantically similar representations close…
Multi-View Hypercomplex Learning for Breast Cancer Screening
Eleonora Lopez, Eleonora Grassucci, Danilo Comminiello
Radiologists interpret mammography exams by jointly analyzing all four views, as correlations among them are crucial for accurate diagnosis. Recent methods employ dedicated fusion…
Gramian Multimodal Representation Learning and Alignment
Giordano Cicchetti, Eleonora Grassucci, Luigi Sigillo +1
Human perception integrates multiple modalities, such as vision, hearing, and language, into a unified understanding of the surrounding reality. While recent multimodal models have…