most citedExploration of Adapter for Noise Robust Automatic Speech Recognition

1 citations · 1 across the 5 of their papers we have counts for

collaborators

5 papers

cs.SD2025

Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement

Hao Shi, Xugang Lu, Kazuki Shimada +1

Diffusion-based speech enhancement (SE) models need to incorporate correct prior knowledge as reliable conditions to generate accurate predictions. However, providing reliable cond…

cs.SD2025

Bridging Speech Emotion Recognition and Personality: Dataset and Temporal Interaction Condition Network

Yuan Gao, Hao Shi, Yahui Fu +2

This study investigates the interaction between personality traits and emotion expression, exploring how personality information can improve speech emotion recognition (SER). We co…

cs.SD2024

Serialized Speech Information Guidance with Overlapped Encoding Separation for Multi-Speaker Automatic Speech Recognition

Hao Shi, Yuan Gao, Zhaoheng Ni +1

Serialized output training (SOT) attracts increasing attention due to its convenience and flexibility for multi-speaker automatic speech recognition (ASR). However, it is not easy…

cs.CL2024

StyEmp: Stylizing Empathetic Response Generation via Multi-Grained Prefix Encoder and Personality Reinforcement

Yahui Fu, Chenhui Chu, Tatsuya Kawahara

Recent approaches for empathetic response generation mainly focus on emotional resonance and user understanding, without considering the system's personality. Consistent personalit…

cs.SD2024★ 1 cited

Exploration of Adapter for Noise Robust Automatic Speech Recognition

Hao Shi, Tatsuya Kawahara

Adapting an automatic speech recognition (ASR) system to unseen noise environments is crucial. Integrating adapters into neural networks has emerged as a potent technique for trans…