1 paper
Keito Kudo, Haruki Nagasawa, Jun Suzuki +1
This paper proposes a practical multimodal video summarization task setting and a dataset to train and evaluate the task. The target task involves summarizing a given video into a…