NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (23)

cs.CL2020

Improved Neural Language Model Fusion for Streaming Recurrent Neural Network Transducer

Suyoun Kim, Yuan Shangguan, Jay Mahadeokar +4

cs.CL2016

Environmental Noise Embeddings for Robust Speech Recognition

Suyoun Kim, Bhiksha Raj, Ian Lane

cs.CL2022

Evaluating User Perception of Speech Recognition System Quality with Semantic Distance Metric

Suyoun Kim, Duc Le, Weiyi Zheng +6

cs.CL2021

Contextualized Streaming End-to-End Speech Recognition with Trie-Based Deep Biasing and Shallow Fusion

Duc Le, Mahaveer Jain, Gil Keren +9

cs.NE2016

Multimodal Transfer Deep Learning with Applications in Audio-Visual Recognition

Seungwhan Moon, Suyoun Kim, Haohan Wang

cs.CL2023

Augmenting text for spoken language understanding with Large Language Models

Roshan Sharma, Suyoun Kim, Daniel Lazar +7

eess.AS2026

Improving Text-to-Audio Instruction Following via Fine-Grained Feedback from Audio-Aware Large Language Models

Chun-Yi Kuan, Siwon Kim, Byeonggeun Kim +8

The paper proposes using audio-aware large language models to give fine‑grained feedback on text‑to‑audio generation, improving how well the generated audio follows multi‑event and…

#text-to-audio synthesis#instruction following#audio-aware language models#preference optimization
cs.CL2018

Dialog-context aware end-to-end speech recognition

Suyoun Kim, Florian Metze

cs.CL2017

Joint CTC-Attention based End-to-End Speech Recognition using Multi-task Learning

Suyoun Kim, Takaaki Hori, Shinji Watanabe

cs.CL2021

Semantic Distance: A New Metric for ASR Performance Analysis Towards Spoken Language Understanding

Suyoun Kim, Abhinav Arora, Duc Le +4

cs.CL2019

Acoustic-to-Word Models with Conversational Context Information

Suyoun Kim, Florian Metze

cs.CL2023

Modality Confidence Aware Training for Robust End-to-End Spoken Language Understanding

Suyoun Kim, Akshat Shrivastava, Duc Le +3

cs.CL2022

Deliberation Model for On-Device Spoken Language Understanding

Duc Le, Akshat Shrivastava, Paden Tomasello +4

cs.CL2020

Improving RNN Transducer Based ASR with Auxiliary Tasks

Chunxi Liu, Frank Zhang, Duc Le +3

cs.CL2018

Improved training for online end-to-end speech recognition systems

Suyoun Kim, Michael L. Seltzer, Jinyu Li +1

cs.LG2016

Recurrent Models for Auditory Attention in Multi-Microphone Distance Speech Recognition

Suyoun Kim, Ian Lane

cs.CL2019

Gated Embeddings in End-to-End Speech Recognition for Conversational-Context Fusion

Suyoun Kim, Siddharth Dalmia, Florian Metze

cs.CL2024

PRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understanding

Trang Le, Daniel Lazar, Suyoun Kim +6

cs.CL2022

Introducing Semantics into Speech Encoders

Derek Xu, Shuyan Dong, Changhan Wang +10

cs.CL2017

Towards Language-Universal End-to-End Speech Recognition

Suyoun Kim, Michael L. Seltzer

eess.AS2025

Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech

Wonjune Kang, Junteng Jia, Chunyang Wu +8

eess.AS2019

Cross-Attention End-to-End ASR for Two-Party Conversations

Suyoun Kim, Siddharth Dalmia, Florian Metze

cs.CL2022

Joint Audio/Text Training for Transformer Rescorer of Streaming Speech Recognition

Suyoun Kim, Ke Li, Lucas Kabela +4