1 paper
Bastian Jäckl, JiÅà Kruchina, Lucas Joos +3
Multimodal deep-learning models power interactive video retrieval by ranking keyframes in response to textual queries. Despite these advances, users must still browse ranked candid…