2 papers
cs.CL2026
DiffuSpeech: Silent Thought, Spoken Answer via Unified Speech-Text Diffusion
Yuxuan Lou, Ziming Wu, Yaochen Wang +6
Current speech language models generate responses directly without explicit reasoning, leading to errors that cannot be corrected once audio is produced. We introduce \textbf{``Sil…
cs.SD2023
EventTrojan: Manipulating Non-Intrusive Speech Quality Assessment via Imperceptible Events
Ying Ren, Kailai Shen, Zhe Ye +1
Non-Intrusive speech quality assessment (NISQA) has gained significant attention for predicting speech's mean opinion score (MOS) without requiring the reference speech. Researcher…