3 citations · 3 across the 2 of their papers we have counts for
4 papers · 1 filter
Explaining Multi-modal Large Language Models by Analyzing their Vision Perception
Loris Giulivi, Giacomo Boracchi
Multi-modal Large Language Models (MLLMs) have demonstrated remarkable capabilities in understanding and generating content across various modalities, such as images and text. Howe…
Concept Visualization: Explaining the CLIP Multi-modal Embedding Using WordNet
Loris Giulivi, Giacomo Boracchi
Advances in multi-modal embeddings, and in particular CLIP, have recently driven several breakthroughs in Computer Vision (CV). CLIP has shown impressive performance on a variety o…
SE3D: A Framework For Saliency Method Evaluation In 3D Imaging
Mariusz Wiśniewski, Loris Giulivi, Giacomo Boracchi
For more than a decade, deep learning models have been dominating in various 2D imaging tasks. Their application is now extending to 3D imaging, with 3D Convolutional Neural Networ…
Perception Visualization: Seeing Through the Eyes of a DNN
Loris Giulivi, Mark James Carman, Giacomo Boracchi
Artificial intelligence (AI) systems power the world we live in. Deep neural networks (DNNs) are able to solve tasks in an ever-expanding landscape of scenarios, but our eagerness…