1 citations · 1 across the 2 of their papers we have counts for
1 paper · 1 filter
Xiping Li, Jianghong Ma
Interleaved-Modal Chain-of-Thought (I-MCoT) advances vision-language reasoning, such as Visual Question Answering (VQA). This paradigm integrates specially selected visual evidence…