1 paper · 1 filter
Fabian Gröger, Shuo Wen, Huyen Le +1
Multimodal models have demonstrated powerful capabilities in complex tasks requiring multimodal alignment, including zero-shot classification and cross-modal retrieval. However, ex…