1 paper
Minghang Zheng, Zihao Yin, Yi Yang +2
Multi-modal Large Language Models (MLLMs) have achieved remarkable progress in video temporal grounding with reinforcement learning for generating reasoning paths. However, existin…