1 paper · 1 filter
Jiale Kang, Ziyin Yue, Qingyu Yin +4
Currently, most multimodal studies are based on large language models (LLMs) with quadratic-complexity Transformer architectures. While linear models like RNNs enjoy low inference…