1 paper · 1 filter
Yi Yang, Xiaokun Zhang, Qingchen Fang +5
Cross-modal artificial intelligence, represented by visual language models, has achieved significant success in general image understanding. However, a fundamental cognitive incons…