Publications (47)
BLEURT: Learning Robust Metrics for Text Generation
Thibault Sellam, Dipanjan Das, Ankur P. Parikh
Learning Recurrent Span Representations for Extractive Question Answering
Kenton Lee, Shimi Salant, Tom Kwiatkowski +3
Learning To Split and Rephrase From Wikipedia Edit History
Jan A. Botha, Manaal Faruqui, John Alex +2
A Decomposable Attention Model for Natural Language Inference
Ankur P. Parikh, Oscar Täckström, Dipanjan Das +1
WikiAtomicEdits: A Multilingual Corpus of Wikipedia Edits for Modeling Language and Discourse
Manaal Faruqui, Ellie Pavlick, Ian Tenney +1
SAILFISH: Vetting Smart Contract State-Inconsistency Bugs in Seconds
Priyanka Bose, Dipanjan Das, Yanju Chen +3
Text-Blueprint: An Interactive Platform for Plan-based Conditional Generation
Fantine Huot, Joshua Maynez, Shashi Narayan +6
Gemini: A Family of Highly Capable Multimodal Models
Gemini Team, Rohan Anil, Sebastian Borgeaud +1340
The MultiBERTs: BERT Reproductions for Robustness Analysis
Thibault Sellam, Steve Yadlowsky, Jason Wei +9
Near-deterministic single-atom loading on a photonic integrated circuit
Xinchao Zhou, Ahreum Lee, Dipanjan Das +2
Task Planning for Object Rearrangement in Multi-room Environments
Karan Mirakhor, Sourav Ghosh, Dipanjan Das +1
Exploiting Unfair Advantages: Investigating Opportunistic Trading in the NFT Market
Priyanka Bose, Dipanjan Das, Fabio Gritti +3
Unveiling the Risks of NFT Promotion Scams
Sayak Saha Roy, Dipanjan Das, Priyanka Bose +3
Decontextualization: Making Sentences Stand-Alone
Eunsol Choi, Jennimaria Palomaki, Matthew Lamm +3
SimpleQA Verified: A Reliable Factuality Benchmark to Measure Parametric Knowledge
Lukas Haas, Gal Yona, Giovanni D'Antonio +2
DOLOMITES: Domain-Specific Long-Form Methodical Tasks
Chaitanya Malaviya, Priyanka Agrawal, Kuzman Ganchev +7
DeepSearchQA: Bridging the Comprehensiveness Gap for Deep Research Agents
Nikita Gupta, Riju Chatterjee, Lukas Haas +9
Increasing Faithfulness in Knowledge-Grounded Dialogue with Controllable Features
Hannah Rashkin, David Reitter, Gaurav Singh Tomar +1
Query Refinement Prompts for Closed-Book Long-Form Question Answering
Reinald Kim Amplayo, Kellie Webster, Michael Collins +2
Understanding Security Issues in the NFT Ecosystem
Dipanjan Das, Priyanka Bose, Nicola Ruaro +2
The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality
Aileen Cheng, Alon Jacovi, Amir Globerson +62
The GEM Benchmark: Natural Language Generation, its Evaluation and Metrics
Sebastian Gehrmann, Tosin Adewumi, Karmanya Aggarwal +53
Text Generation with Exemplar-based Adaptive Decoding
Hao Peng, Ankur P. Parikh, Manaal Faruqui +2
Anticipate & Collab: Data-driven Task Anticipation and Knowledge-driven Planning for Human-robot Collaboration
Shivam Singh, Karthik Swaminathan, Raghav Arora +6
Conditional Generation with a Question-Answering Blueprint
Shashi Narayan, Joshua Maynez, Reinald Kim Amplayo +6
QAmeleon: Multilingual QA with Only 5 Examples
Priyanka Agrawal, Chris Alberti, Fantine Huot +6
Deep Representation Learning Characterized by Inter-class Separation for Image Clustering
Dipanjan Das, Ratul Ghosh, Brojeshwar Bhowmick
Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context
Gemini Team, Petko Georgiev, Ving Ian Lei +1132
Language Models are Multilingual Chain-of-Thought Reasoners
Freda Shi, Mirac Suzgun, Markus Freitag +9
The FACTS Grounding Leaderboard: Benchmarking LLMs' Ability to Ground Responses to Long-Form Input
Alon Jacovi, Andrew Wang, Chris Alberti +23
What do you learn from context? Probing for sentence structure in contextualized word representations
Ian Tenney, Patrick Xia, Berlin Chen +8
Neural Paraphrase Identification of Questions with Noisy Pretraining
Gaurav Singh Tomar, Thyago Duque, Oscar Täckström +2
A Universal Part-of-Speech Tagset
Slav Petrov, Dipanjan Das, Ryan McDonald
Epipolar Geometry based Learning of Multi-view Depth and Ego-Motion from Monocular Sequences
Vignesh Prasad, Dipanjan Das, Brojeshwar Bhowmick
Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
Gheorghe Comanici, Eric Bieber, Mike Schaekermann +3431
Attributed Question Answering: Evaluation and Modeling for Attributed Large Language Models
Bernd Bohnet, Vinh Q. Tran, Pat Verga +19
A Well-Composed Text is Half Done! Composition Sampling for Diverse Conditional Generation
Shashi Narayan, Gonçalo Simões, Yao Zhao +4
Syntactic Data Augmentation Increases Robustness to Inference Heuristics
Junghyun Min, R. Thomas McCoy, Dipanjan Das +2
Variational Clustering: Leveraging Variational Autoencoders for Image Clustering
Vignesh Prasad, Dipanjan Das, Brojeshwar Bhowmick
Identifying Well-formed Natural Language Questions
Manaal Faruqui, Dipanjan Das
BERT Rediscovers the Classical NLP Pipeline
Ian Tenney, Dipanjan Das, Ellie Pavlick
Handling Divergent Reference Texts when Evaluating Table-to-Text Generation
Bhuwan Dhingra, Manaal Faruqui, Ankur Parikh +3
SEAHORSE: A Multilingual, Multifaceted Dataset for Summarization Evaluation
Elizabeth Clark, Shruti Rijhwani, Sebastian Gehrmann +7
Learning to Evaluate Translation Beyond English: BLEURT Submissions to the WMT Metrics 2020 Shared Task
Thibault Sellam, Amy Pu, Hyung Won Chung +5
Columbus: Android App Testing Through Systematic Callback Exploration
Priyanka Bose, Dipanjan Das, Saastha Vasan +6
ToTTo: A Controlled Table-To-Text Generation Dataset
Ankur P. Parikh, Xuezhi Wang, Sebastian Gehrmann +4
Measuring Attribution in Natural Language Generation Models
Hannah Rashkin, Vitaly Nikolaev, Matthew Lamm +7