1 paper
Shengyao Zhuang, Ekaterina Khramtsova, Xueguang Ma +3
Recent advancements in dense retrieval have introduced vision-language model (VLM)-based retrievers, such as DSE and ColPali, which leverage document screenshots embedded as vector…