1 paper
Heqing Zou, Tianze Luo, Guiyang Xie +7
Multimodal large language models have become a popular topic in deep visual understanding due to many promising real-world applications. However, hour-long video understanding, spa…