1 paper
Tinghui Zhu, Kai Zhang, Muhao Chen +1
Omni-modal language models (OLMs) aim to integrate and reason over diverse input modalities--such as text, images, video, and audio--while maintaining strong language capabilities.…