1 paper
Haolei Xu, Haiwen Hong, Hongxing Li +7
Multimodal Mixture-of-Experts (MoE) models have achieved remarkable performance on vision-language tasks. However, we identify a puzzling phenomenon termed Seeing but Not Thinking:…