1 paper
Zihui Cheng, Qiguang Chen, Jin Zhang +5
Large Vision-Language Models (LVLMs) have recently demonstrated amazing success in multi-modal tasks, including advancements in Multi-modal Chain-of-Thought (MCoT) reasoning. Despi…