NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (32)

cs.CL2019

Audio De-identification: A New Entity Recognition Task

Ido Cohn, Itay Laish, Genady Beryozkin +6

cs.CL2025

Gemini: A Family of Highly Capable Multimodal Models

Gemini Team, Rohan Anil, Sebastian Borgeaud +1340

cs.CL2019

Joint Speech Recognition and Speaker Diarization via Sequence Transduction

Laurent El Shafey, Hagen Soltau, Izhak Shafran

cs.CR2020

Google COVID-19 Search Trends Symptoms Dataset: Anonymization Process Description (version 1.0)

Shailesh Bavadekar, Andrew Dai, John Davis +27

cs.CL2023

AnyTOD: A Programmable Task-Oriented Dialog System

Jeffrey Zhao, Yuan Cao, Raghav Gupta +6

cs.CL2019

Learning to Infer Entities, Properties and their Relations from Clinical Conversations

Nan Du, Mingqiu Wang, Linh Tran +2

eess.AS2023

Efficient Adapters for Giant Speech Models

Nanxin Chen, Izhak Shafran, Yu Zhang +4

cs.CL2023

ReAct: Synergizing Reasoning and Acting in Language Models

Shunyu Yao, Jeffrey Zhao, Dian Yu +4

cs.CL2023

Tree of Thoughts: Deliberate Problem Solving with Large Language Models

Shunyu Yao, Dian Yu, Jeffrey Zhao +4

cs.LG2019

Complex Evolution Recurrent Neural Networks (ceRNNs)

Izhak Shafran, Tom Bagby, R. J. Skerry-Ryan

cs.LG2023

MUX-PLMs: Data Multiplexing for High-throughput Language Models

Vishvak Murahari, Ameet Deshpande, Carlos E. Jimenez +4

cs.CL2022

Knowledge-grounded Dialog State Tracking

Dian Yu, Mingqiu Wang, Yuan Cao +3

cs.CL2024

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team, Petko Georgiev, Ving Ian Lei +1132

cs.CL2021

Word-level confidence estimation for RNN transducers

Mingqiu Wang, Hagen Soltau, Laurent El Shafey +1

cs.RO2024

Learning to Learn Faster from Human Feedback with Language Model Predictive Control

Jacky Liang, Fei Xia, Wenhao Yu +47

cs.CL2019

Extracting Symptoms and their Status from Clinical Conversations

Nan Du, Kai Chen, Anjuli Kannan +3

cs.CL2024

Retrieval Augmented End-to-End Spoken Dialog Models

Mingqiu Wang, Izhak Shafran, Hagen Soltau +4

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cs.CL2021

R2D2: Relational Text Decoding with Transformers

Aryan Arbabi, Mingqiu Wang, Laurent El Shafey +2

cs.CL2020

The Medical Scribe: Corpus Development and Model Performance Analyses

Izhak Shafran, Nan Du, Linh Tran +11

cs.CL2022

RNN Transducers for Nested Named Entity Recognition with constraints on alignment for long sequences

Hagen Soltau, Izhak Shafran, Mingqiu Wang +1

cs.CL2026

Gemma 4 Technical Report

Gemma Team, Sherif El Abd, Vaibhav Aggarwal +320

cs.RO2023

RoboVQA: Multimodal Long-Horizon Reasoning for Robotics

Pierre Sermanet, Tianli Ding, Jeffrey Zhao +18

cs.CL2023

SLM: Bridge the thin gap between speech and text foundation models

Mingqiu Wang, Wei Han, Izhak Shafran +15

cs.AI2022

Speech Aware Dialog System Technology Challenge (DSTC11)

Hagen Soltau, Izhak Shafran, Mingqiu Wang +6

eess.AS2023

Detecting Speech Abnormalities with a Perceiver-based Sequence Classifier that Leverages a Universal Speech Model

Hagen Soltau, Izhak Shafran, Alex Ottenwess +7

cs.CL2025

Knowledge Graph Reasoning with Self-supervised Reinforcement Learning

Ying Ma, Owen Burns, Mingqiu Wang +6

cs.CL2022

Unsupervised Slot Schema Induction for Task-oriented Dialog

Dian Yu, Mingqiu Wang, Yuan Cao +3

cs.CL2022

Description-Driven Task-Oriented Dialog Modeling

Jeffrey Zhao, Raghav Gupta, Yuan Cao +6

cs.LG2021

Understanding Medical Conversations: Rich Transcription, Confidence Scores & Information Extraction

Hagen Soltau, Mingqiu Wang, Izhak Shafran +1

eess.AS2023

Speech-to-Text Adapter and Speech-to-Entity Retriever Augmented LLMs for Speech Understanding

Mingqiu Wang, Izhak Shafran, Hagen Soltau +4

cs.CV2016

Fuzzy Statistical Matrices for Cell Classification

Guillaume Thibault, Izhak Shafran