1 paper
Chenxin Fang, Tao Chen, JunChao You +3
In this paper, we propose a new token compression paradigm for video Multimodal Large Language Models (MLLMs), termed Visual Token Coding (VTC). Inspired by classical video coding…