NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (47)

cs.CL2020

BLEURT: Learning Robust Metrics for Text Generation

Thibault Sellam, Dipanjan Das, Ankur P. Parikh

cs.CL2017

Learning Recurrent Span Representations for Extractive Question Answering

Kenton Lee, Shimi Salant, Tom Kwiatkowski +3

cs.CL2018

Learning To Split and Rephrase From Wikipedia Edit History

Jan A. Botha, Manaal Faruqui, John Alex +2

cs.CL2016

A Decomposable Attention Model for Natural Language Inference

Ankur P. Parikh, Oscar Täckström, Dipanjan Das +1

cs.CL2018

WikiAtomicEdits: A Multilingual Corpus of Wikipedia Edits for Modeling Language and Discourse

Manaal Faruqui, Ellie Pavlick, Ian Tenney +1

cs.CR2021

SAILFISH: Vetting Smart Contract State-Inconsistency Bugs in Seconds

Priyanka Bose, Dipanjan Das, Yanju Chen +3

cs.CL2023

Text-Blueprint: An Interactive Platform for Plan-based Conditional Generation

Fantine Huot, Joshua Maynez, Shashi Narayan +6

cs.CL2025

Gemini: A Family of Highly Capable Multimodal Models

Gemini Team, Rohan Anil, Sebastian Borgeaud +1340

cs.CL2022

The MultiBERTs: BERT Reproductions for Robustness Analysis

Thibault Sellam, Steve Yadlowsky, Jason Wei +9

quant-ph2026

Near-deterministic single-atom loading on a photonic integrated circuit

Xinchao Zhou, Ahreum Lee, Dipanjan Das +2

cs.RO2024

Task Planning for Object Rearrangement in Multi-room Environments

Karan Mirakhor, Sourav Ghosh, Dipanjan Das +1

q-fin.TR2023

Exploiting Unfair Advantages: Investigating Opportunistic Trading in the NFT Market

Priyanka Bose, Dipanjan Das, Fabio Gritti +3

cs.CR2023

Unveiling the Risks of NFT Promotion Scams

Sayak Saha Roy, Dipanjan Das, Priyanka Bose +3

cs.CL2021

Decontextualization: Making Sentences Stand-Alone

Eunsol Choi, Jennimaria Palomaki, Matthew Lamm +3

cs.CL2026

SimpleQA Verified: A Reliable Factuality Benchmark to Measure Parametric Knowledge

Lukas Haas, Gal Yona, Giovanni D'Antonio +2

cs.CL2024

DOLOMITES: Domain-Specific Long-Form Methodical Tasks

Chaitanya Malaviya, Priyanka Agrawal, Kuzman Ganchev +7

cs.CL2026

DeepSearchQA: Bridging the Comprehensiveness Gap for Deep Research Agents

Nikita Gupta, Riju Chatterjee, Lukas Haas +9

cs.CL2021

Increasing Faithfulness in Knowledge-Grounded Dialogue with Controllable Features

Hannah Rashkin, David Reitter, Gaurav Singh Tomar +1

cs.CL2022

Query Refinement Prompts for Closed-Book Long-Form Question Answering

Reinald Kim Amplayo, Kellie Webster, Michael Collins +2

cs.CR2022

Understanding Security Issues in the NFT Ecosystem

Dipanjan Das, Priyanka Bose, Nicola Ruaro +2

cs.CL2025

The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality

Aileen Cheng, Alon Jacovi, Amir Globerson +62

cs.CL2021

The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics

Sebastian Gehrmann, Tosin Adewumi, Karmanya Aggarwal +53

cs.CL2019

Text Generation with Exemplar-based Adaptive Decoding

Hao Peng, Ankur P. Parikh, Manaal Faruqui +2

cs.RO2024

Anticipate & Collab: Data-driven Task Anticipation and Knowledge-driven Planning for Human-robot Collaboration

Shivam Singh, Karthik Swaminathan, Raghav Arora +6

cs.CL2023

Conditional Generation with a Question-Answering Blueprint

Shashi Narayan, Joshua Maynez, Reinald Kim Amplayo +6

cs.CL2023

QAmeleon: Multilingual QA with Only 5 Examples

Priyanka Agrawal, Chris Alberti, Fantine Huot +6

cs.CV2019

Deep Representation Learning Characterized by Inter-class Separation for Image Clustering

Dipanjan Das, Ratul Ghosh, Brojeshwar Bhowmick

cs.CL2024

Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Gemini Team, Petko Georgiev, Ving Ian Lei +1132

cs.CL2022

Language Models are Multilingual Chain-of-Thought Reasoners

Freda Shi, Mirac Suzgun, Markus Freitag +9

cs.CL2025

The FACTS Grounding Leaderboard: Benchmarking LLMs' Ability to Ground Responses to Long-Form Input

Alon Jacovi, Andrew Wang, Chris Alberti +23

cs.CL2019

What do you learn from context? Probing for sentence structure in contextualized word representations

Ian Tenney, Patrick Xia, Berlin Chen +8

cs.CL2017

Neural Paraphrase Identification of Questions with Noisy Pretraining

Gaurav Singh Tomar, Thyago Duque, Oscar Täckström +2

cs.CL2011

A Universal Part-of-Speech Tagset

Slav Petrov, Dipanjan Das, Ryan McDonald

cs.RO2019

Epipolar Geometry based Learning of Multi-view Depth and Ego-Motion from Monocular Sequences

Vignesh Prasad, Dipanjan Das, Brojeshwar Bhowmick

cs.CL2025

Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities

Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431

cs.CL2023

Attributed Question Answering: Evaluation and Modeling for Attributed Large Language Models

Bernd Bohnet, Vinh Q. Tran, Pat Verga +19

cs.CL2022

A Well-Composed Text is Half Done! Composition Sampling for Diverse Conditional Generation

Shashi Narayan, Gonçalo Simões, Yao Zhao +4

cs.CL2020

Syntactic Data Augmentation Increases Robustness to Inference Heuristics

Junghyun Min, R. Thomas McCoy, Dipanjan Das +2

cs.CV2020

Variational Clustering: Leveraging Variational Autoencoders for Image Clustering

Vignesh Prasad, Dipanjan Das, Brojeshwar Bhowmick

cs.CL2018

Identifying Well-formed Natural Language Questions

Manaal Faruqui, Dipanjan Das

cs.CL2019

BERT Rediscovers the Classical NLP Pipeline

Ian Tenney, Dipanjan Das, Ellie Pavlick

cs.CL2019

Handling Divergent Reference Texts when Evaluating Table-to-Text Generation

Bhuwan Dhingra, Manaal Faruqui, Ankur Parikh +3

cs.CL2023

SEAHORSE: A Multilingual, Multifaceted Dataset for Summarization Evaluation

Elizabeth Clark, Shruti Rijhwani, Sebastian Gehrmann +7

cs.CL2020

Learning to Evaluate Translation Beyond English: BLEURT Submissions to the WMT Metrics 2020 Shared Task

Thibault Sellam, Amy Pu, Hyung Won Chung +5

cs.SE2023

Columbus: Android App Testing Through Systematic Callback Exploration

Priyanka Bose, Dipanjan Das, Saastha Vasan +6

cs.CL2020

ToTTo: A Controlled Table-To-Text Generation Dataset

Ankur P. Parikh, Xuezhi Wang, Sebastian Gehrmann +4

cs.CL2022

Measuring Attribution in Natural Language Generation Models

Hannah Rashkin, Vitaly Nikolaev, Matthew Lamm +7