1 paper
Yejin Kwon, Taewoo Kang, Hyunsoo Yoon +1
We present M3-SLU, a new multimodal large language model (MLLM) benchmark for evaluating multi-speaker, multi-turn spoken language understanding. While recent models show strong pe…