1 paper
Chi-Yuan Hsiao, Ke-Han Lu, Yu-Kuan Fu +3
End-to-end full-duplex Speech Language Models (SLMs) require precise turn-taking for natural interaction. However, optimizing temporal dynamics via standard raw-token reinforcement…