NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (28)

cs.CL2020

AlloVera: A Multilingual Allophone Database

David R. Mortensen, Xinjian Li, Patrick Littell +6

cs.CL2024

Towards Robust Speech Representation Learning for Thousands of Languages

William Chen, Wangyou Zhang, Yifan Peng +7

stat.ML2021

Revisiting Factorizing Aggregated Posterior in Learning Disentangled Representations

Ze Cheng, Juncheng Li, Chenxu Wang +4

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cond-mat.mtrl-sci2025

Light-Emitting Diodes based on Metal Halide Perovskite and Perovskite Related Nanocrystals

Ying Liu, Zhuangzhuang Ma, Jibin Zhang +5

cs.LG2021

Multi-Faceted Hierarchical Multi-Task Learning for a Large Number of Tasks with Multi-dimensional Relations

Junning Liu, Zijie Xia, Yu Lei +2

cs.CL2021

Acoustics Based Intent Recognition Using Discovered Phonetic Units for Low Resource Languages

Akshat Gupta, Xinjian Li, Sai Krishna Rallabandi +1

cs.CL2020

Universal Phone Recognition with a Multilingual Allophone System

Xinjian Li, Siddharth Dalmia, Juncheng Li +8

eess.AS2023

Learning to Speak from Text: Zero-Shot Multilingual Text-to-Speech with Unsupervised Text Pretraining

Takaaki Saeki, Soumi Maiti, Xinjian Li +3

cs.CL2018

Real-time Neural-based Input Method

Jiali Yao, Raphael Shu, Xinjian Li +2

cs.CR2019

Adversarial Music: Real World Audio Adversary Against Wake-word Detection System

Juncheng B. Li, Shuhui Qu, Xinjian Li +3

cs.CL2023

Reproducing Whisper-Style Training Using an Open-Source Toolkit and Publicly Available Data

Yifan Peng, Jinchuan Tian, Brian Yan +13

cs.CL2024

YODAS: Youtube-Oriented Dataset for Audio and Speech

Xinjian Li, Shinnosuke Takamichi, Takaaki Saeki +3

cs.CL2019

Multilingual Speech Recognition with Corpus Relatedness Sampling

Xinjian Li, Siddharth Dalmia, Alan W. Black +1

cs.CL2020

A Summary of the First Workshop on Language Technology for Language Documentation and Revitalization

Graham Neubig, Shruti Rijhwani, Alexis Palmer +21

cs.CL2019

The ARIEL-CMU Systems for LoReHLT18

Aditi Chaudhary, Siddharth Dalmia, Junjie Hu +27

cs.CL2022

Textless Direct Speech-to-Speech Translation with Discrete Speech Representation

Xinjian Li, Ye Jia, Chung-Cheng Chiu

cs.SD2021

On Prosody Modeling for ASR+TTS based Voice Conversion

Wen-Chin Huang, Tomoki Hayashi, Xinjian Li +2

cs.CL2020

Towards Zero-shot Learning for Automatic Phonemic Transcription

Xinjian Li, Siddharth Dalmia, David R. Mortensen +3

cs.CL2019

Phoneme Level Language Models for Sequence Based Low Resource ASR

Siddharth Dalmia, Xinjian Li, Alan W Black +1

cs.CL2022

ASR2K: Speech Recognition for Around 2000 Languages without Audio

Xinjian Li, Florian Metze, David R Mortensen +2

cs.CL2024

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team, Petko Georgiev, Ving Ian Lei +1132

cs.SD2022

On Adversarial Robustness of Large-scale Audio Visual Learning

Juncheng B Li, Shuhui Qu, Xinjian Li +2

cs.CL2019

SANTLR: Speech Annotation Toolkit for Low Resource Languages

Xinjian Li, Zhong Zhou, Siddharth Dalmia +2

cs.CL2021

Phoneme Recognition through Fine Tuning of Phonetic Representations: a Case Study on Luhya Language Varieties

Kathleen Siminyu, Xinjian Li, Antonios Anastasopoulos +3

cs.CV2020

Semi-Supervised Recognition under a Noisy and Fine-grained Dataset

Cheng Cui, Zhi Ye, Yangxi Li +7

cs.CL2018

Domain Robust Feature Extraction for Rapid Low Resource ASR Development

Siddharth Dalmia, Xinjian Li, Florian Metze +1

cs.CL2021

Tusom2021: A Phonetically Transcribed Speech Dataset from an Endangered Language for Universal Phone Recognition Experiments

David R. Mortensen, Jordan Picone, Xinjian Li +1