1 paper
Jiale Kang, Ziyin Yue, Qingyu Yin +4
Currently, most multimodal studies are based on large language models (LLMs) with quadratic-complexity Transformer architectures. While linear models like RNNs enjoy low inference…