1 paper
Hualei Wang, Jianguo Mao, Zhifang Guo +3
Large language models reveal deep comprehension and fluent generation in the field of multi-modality. Although significant advancements have been achieved in audio multi-modality,…