1 paper
Jiayang Gu, Fengming Yao
Video captioning models easily suffer from long-tail distribution of phrases, which makes captioning models prone to generate vague sentences instead of accurate ones. However, exi…