1 paper · 1 filter
Mingxiao Huo, Pengliang Ji, Haotian Lin +3
We introduce a pioneering unified library that leverages depth anything, segment anything models to augment neural comprehension in language-vision model zero-shot understanding. T…