Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Where Do Multilingual Vision-Language Encoders Fail on Low-Resource Languages?
Donghoon Han, SungHyun Moon, Aidyn Zhakatayev +2
Recent multilingual vision--language encoders cover hundreds of languages in a single model, yet on two state-of-the-art instances retrieval on low-resource languages (LRL; e.g. Sw…
cs.CL2024
MERLIN: Multimodal Embedding Refinement via LLM-based Iterative Navigation for Text-Video Retrieval-Rerank Pipeline
Donghoon Han, Eunhwan Park, Gisang Lee +2
The rapid expansion of multimedia content has made accurately retrieving relevant videos from large collections increasingly challenging. Recent advancements in text-video retrieva…