1 paper
Dhiman Paul, Md Rizwan Parvez, Nabeel Mohammed +1
Prevailing joint prediction transformers for Video Highlight Detection and Moment Retrieval (HD/MR) exhibit deficiencies in handling cross-task dynamics, achieving robust video-tex…