NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (239)

cs.CL2024

MUSE: Machine Unlearning Six-Way Evaluation for Language Models

Weijia Shi, Jaechan Lee, Yangsibo Huang +7

cs.CL2020

RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models

Samuel Gehman, Suchin Gururangan, Maarten Sap +2

cs.CL2023

Elaboration-Generating Commonsense Question Answering at Scale

Wenya Wang, Vivek Srikumar, Hanna Hajishirzi +1

cs.CL2022

Whose Language Counts as High Quality? Measuring Language Ideologies in Text Data Selection

Suchin Gururangan, Dallas Card, Sarah K. Dreier +5

cs.CL2025

Tulu 3: Pushing Frontiers in Open Language Model Post-Training

Nathan Lambert, Jacob Morrison, Valentina Pyatkin +20

cs.CL2022

Time Waits for No One! Analysis and Challenges of Temporal Misalignment

Kelvin Luu, Daniel Khashabi, Suchin Gururangan +2

cs.CL2016

Training with Exploration Improves a Greedy Stack-LSTM Parser

Miguel Ballesteros, Yoav Goldberg, Chris Dyer +1

cs.CL2024

RealTime QA: What's the Answer Right Now?

Jungo Kasai, Keisuke Sakaguchi, Yoichi Takahashi +7

cs.CL2019

LSTMs Exploit Linguistic Attributes of Data

Nelson F. Liu, Omer Levy, Roy Schwartz +2

cs.CL2019

To Tune or Not to Tune? Adapting Pretrained Representations to Diverse Tasks

Matthew E. Peters, Sebastian Ruder, Noah A. Smith

cs.CL2019

Polyglot Contextual Representations Improve Crosslingual Transfer

Phoebe Mulcaire, Jungo Kasai, Noah A. Smith

cs.CL2022

How Much Does Attention Actually Attend? Questioning the Importance of Attention in Pretrained Transformers

Michael Hassid, Hao Peng, Daniel Rotem +4

cs.AI2025

MMMG: a Comprehensive and Reliable Evaluation Suite for Multitask Multimodal Generation

Jihan Yao, Yushi Hu, Yujie Yi +9

cs.CL2020

Contextual Word Representations: A Contextual Introduction

Noah A. Smith

cs.CL2019

Evaluating Gender Bias in Machine Translation

Gabriel Stanovsky, Noah A. Smith, Luke Zettlemoyer

cs.CL2026

Bolmo: Byteifying the Next Generation of Language Models

Benjamin Minixhofer, Tyler Murray, Tomasz Limisiewicz +6

cs.CL2020

Grounded Compositional Outputs for Adaptive Language Modeling

Nikolaos Pappas, Phoebe Mulcaire, Noah A. Smith

cs.CL2021

A Dataset of Information-Seeking Questions and Answers Anchored in Research Papers

Pradeep Dasigi, Kyle Lo, Iz Beltagy +3

cs.CL2023

How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources

Yizhong Wang, Hamish Ivison, Pradeep Dasigi +8

cs.CL2025

Sample, Don't Search: Rethinking Test-Time Alignment for Language Models

Gonçalo Faria, Noah A. Smith

cs.CL2016

Distilling an Ensemble of Greedy Dependency Parsers into One MST Parser

Adhiguna Kuncoro, Miguel Ballesteros, Lingpeng Kong +2

cs.CL2026

Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior

Rahul Nadkarni, Yanai Elazar, Hila Gonen +1

cs.CL2016

Segmental Recurrent Neural Networks

Lingpeng Kong, Chris Dyer, Noah A. Smith

cs.LG2026

Olmo Hybrid: From Theory to Practice and Back

William Merrill, Yanhong Li, Tyler Romero +19

cs.CL2025

FlexOlmo: Open Language Models for Flexible Data Use

Weijia Shi, Akshita Bhagia, Kevin Farhat +20

cs.CL2024

Summarization-Based Document IDs for Generative Retrieval with Language Models

Haoxin Li, Daniel Cheng, Phillip Keung +2

cs.CL2022

Super-NaturalInstructions: Generalization via Declarative Instructions on 1600+ NLP Tasks

Yizhong Wang, Swaroop Mishra, Pegah Alipoormolabashi +37

cs.CV2025

LEGATO: Large-scale End-to-end Generalizable Approach to Typeset OMR

Guang Yang, Victoria Ebert, Nazif Tamer +3

cs.CL2019

Improving Natural Language Inference with a Pretrained Parser

Deric Pang, Lucy H. Lin, Noah A. Smith

cs.CL2026

Reading Between the Lines: The One-Sided Conversation Problem

Victoria Ebert, Rishabh Singh, Tuochao Chen +2

cs.CL2023

Self-Instruct: Aligning Language Models with Self-Generated Instructions

Yizhong Wang, Yeganeh Kordi, Swaroop Mishra +4

cs.CL2024

Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects

Orevaoghene Ahia, Anuoluwapo Aremu, Diana Abagyan +5

cs.CL2015

Retrofitting Word Vectors to Semantic Lexicons

Manaal Faruqui, Jesse Dodge, Sujay K. Jauhar +3

cs.CL2020

Unsupervised Bitext Mining and Translation via Self-trained Contextual Embeddings

Phillip Keung, Julian Salazar, Yichao Lu +1

cs.SD2026

BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning

Min Jang, Orevaoghene Ahia, Nazif Tamer +3

cs.CL2018

Annotation Artifacts in Natural Language Inference Data

Suchin Gururangan, Swabha Swayamdipta, Omer Levy +3

cs.CL2025

SuperBPE: Space Travel for Language Models

Alisa Liu, Jonathan Hayase, Valentin Hofmann +3

cs.CL2018

Backpropagating through Structured Argmax using a SPIGOT

Hao Peng, Sam Thomson, Noah A. Smith

cs.CL2024

Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models

Terra Blevins, Tomasz Limisiewicz, Suchin Gururangan +4

cs.CL2017

End-to-End Neural Segmental Models for Speech Recognition

Hao Tang, Liang Lu, Lingpeng Kong +5

cs.HC2025

How Performance Pressure Influences AI-Assisted Decision Making

Nikita Haduong, Noah A. Smith

cs.CL2015

Improved Transition-Based Parsing by Modeling Characters instead of Words with LSTMs

Miguel Ballesteros, Chris Dyer, Noah A. Smith

cs.CL2023

Transparency Helps Reveal When Language Models Learn Meaning

Zhaofeng Wu, William Merrill, Hao Peng +2

cs.CL2024

Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging

Jacob Morrison, Noah A. Smith, Hannaneh Hajishirzi +3

cs.CL2023

Data-Efficient Finetuning Using Cross-Task Nearest Neighbors

Hamish Ivison, Noah A. Smith, Hannaneh Hajishirzi +1

cs.CL2015

Annotating Character Relationships in Literary Texts

Philip Massey, Patrick Xia, David Bamman +1

cs.SI2013

Predicting the NFL using Twitter

Shiladitya Sinha, Chris Dyer, Kevin Gimpel +1

cs.CL2025

Fluid Language Model Benchmarking

Valentin Hofmann, David Heineman, Ian Magnusson +7

cs.CL2019

PaLM: A Hybrid Parser and Language Model

Hao Peng, Roy Schwartz, Noah A. Smith

cs.CL2017

What Do Recurrent Neural Network Grammars Learn About Syntax?

Adhiguna Kuncoro, Miguel Ballesteros, Lingpeng Kong +3

cs.CL2025

On Linear Representations and Pretraining Data Frequency in Language Models

Jack Merullo, Noah A. Smith, Sarah Wiegreffe +1

cs.CL2024

Estimating the Causal Effect of Early ArXiving on Paper Acceptance

Yanai Elazar, Jiayao Zhang, David Wadden +2

cs.AI2025

BLAB: Brutally Long Audio Bench

Orevaoghene Ahia, Martijn Bartelds, Kabir Ahuja +13

cs.CL2025

Evaluating $n$-Gram Novelty of Language Models Using Rusty-DAWG

William Merrill, Noah A. Smith, Yanai Elazar

cs.CL2024

Efficient Encoder-Decoder Transformer Decoding for Decomposable Tasks

Bo-Ru Lu, Nikita Haduong, Chien-Yu Lin +3

cs.CL2021

Finetuning Pretrained Transformers into RNNs

Jungo Kasai, Hao Peng, Yizhe Zhang +6

cs.CV2024

Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models

Matt Deitke, Christopher Clark, Sangho Lee +47

cs.LG2026

Encode Once, Decode Never: Reusing Audio LM Internals for Efficient Temporal Localization

Joesph An, Joseph An, Phillip Keung +3

cs.CL2024

Tuning Language Models by Proxy

Alisa Liu, Xiaochuang Han, Yizhong Wang +3

cs.CY2013

Inferring Social Rank in an Old Assyrian Trade Network

David Bamman, Adam Anderson, Noah A. Smith

cs.CL2025

Establishing Task Scaling Laws via Compute-Efficient Model Ladders

Akshita Bhagia, Jiacheng Liu, Alexander Wettig +9

cs.CL2020

The Multilingual Amazon Reviews Corpus

Phillip Keung, Yichao Lu, György Szarvas +1

cs.CL2022

Unsupervised Learning of Hierarchical Conversation Structure

Bo-Ru Lu, Yushi Hu, Hao Cheng +2

cs.CL2024

Evaluating Copyright Takedown Methods for Language Models

Boyi Wei, Weijia Shi, Yangsibo Huang +5

cs.CL2023

Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2

Hamish Ivison, Yizhong Wang, Valentina Pyatkin +8

cs.CL2022

Parsing with Multilingual BERT, a Small Corpus, and a Small Treebank

Ethan C. Chau, Lucy H. Lin, Noah A. Smith

cs.LG2021

Topics to Avoid: Demoting Latent Confounds in Text Classification

Sachin Kumar, Shuly Wintner, Noah A. Smith +1

cs.CL2018

Learning Joint Semantic Parsers from Disjoint Data

Hao Peng, Sam Thomson, Swabha Swayamdipta +1

cs.CL2023

Fine-Grained Human Feedback Gives Better Rewards for Language Model Training

Zeqiu Wu, Yushi Hu, Weijia Shi +6

cs.CL2024

Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback

Hamish Ivison, Yizhong Wang, Jiacheng Liu +6

cs.CL2026

Olmo 3

Team Olmo, :, Allyson Ettinger +66

cs.CL2016

Character Sequence Models for ColorfulWords

Kazuya Kawakami, Chris Dyer, Bryan R. Routledge +1

cs.AI2025

The Leaderboard Illusion

Shivalika Singh, Yiyang Nan, Alex Wang +10

cs.CL2021

DEMix Layers: Disentangling Domains for Modular Language Modeling

Suchin Gururangan, Mike Lewis, Ari Holtzman +2

cs.AI2020

On Consequentialism and Fairness

Dallas Card, Noah A. Smith

cs.CL2021

Challenges in Automated Debiasing for Toxic Language Detection

Xuhui Zhou, Maarten Sap, Swabha Swayamdipta +2

cs.CL2018

Rational Recurrences

Hao Peng, Roy Schwartz, Sam Thomson +1

cs.CL2022

Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation

Ofir Press, Noah A. Smith, Mike Lewis

cs.CL2023

NarrowBERT: Accelerating Masked Language Model Pretraining and Inference

Haoxin Li, Phillip Keung, Daniel Cheng +2

cs.CL2026

Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations

Brian Siyuan Zheng, Alisa Liu, Orevaoghene Ahia +3

cs.CL2023

We're Afraid Language Models Aren't Modeling Ambiguity

Alisa Liu, Zhaofeng Wu, Julian Michael +6

cs.CL2017

The Effect of Different Writing Tasks on Linguistic Style: A Case Study of the ROC Story Cloze Task

Roy Schwartz, Maarten Sap, Ioannis Konstas +3

cs.SI2017

Friendships, Rivalries, and Trysts: Characterizing Relations between Ideas in Texts

Chenhao Tan, Dallas Card, Noah A. Smith

cs.CL2023

Language Models: A Guide for the Perplexed

Sofia Serrano, Zander Brumbaugh, Noah A. Smith

cs.CL2023

Measuring and Narrowing the Compositionality Gap in Language Models

Ofir Press, Muru Zhang, Sewon Min +3

cs.CL2016

Massively Multilingual Word Embeddings

Waleed Ammar, George Mulcaire, Yulia Tsvetkov +3

cs.AI2026

Beyond One Output: Visualizing and Comparing Distributions of Language Model Generations

Emily Reif, Claire Yang, Jared Hwang +3

cs.CL2023

Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models

Orevaoghene Ahia, Sachin Kumar, Hila Gonen +4

cs.CL2022

Domain Mismatch Doesn't Always Prevent Cross-Lingual Transfer Learning

Daniel Edmiston, Phillip Keung, Noah A. Smith

cs.CL2019

Quoref: A Reading Comprehension Dataset with Questions Requiring Coreferential Reasoning

Pradeep Dasigi, Nelson F. Liu, Ana Marasović +2

cs.CL2018

Greedy, Joint Syntactic-Semantic Parsing with Stack LSTMs

Swabha Swayamdipta, Miguel Ballesteros, Chris Dyer +1

cs.HC2024

Know Your Audience: The benefits and pitfalls of generating plain language summaries beyond the "general" audience

Tal August, Kyle Lo, Noah A. Smith +1

cs.CL2013

New Alignment Methods for Discriminative Book Summarization

David Bamman, Noah A. Smith

cs.CL2025

Hybrid Preferences: Learning to Route Instances for Human vs. AI Feedback

Lester James V. Miranda, Yizhong Wang, Yanai Elazar +6

cs.CL2019

Situating Sentence Embedders with Nearest Neighbor Overlap

Lucy H. Lin, Noah A. Smith

cs.CL2023

Stubborn Lexical Bias in Data and Models

Sofia Serrano, Jesse Dodge, Noah A. Smith

cs.CL2022

Saturated Transformers are Constant-Depth Threshold Circuits

William Merrill, Ashish Sabharwal, Noah A. Smith

cs.CL2023

Morphosyntactic probing of multilingual BERT models

Judit Acs, Endre Hamerlik, Roy Schwartz +2

cs.CL2022

Annotators with Attitudes: How Annotator Beliefs And Identities Bias Toxic Language Detection

Maarten Sap, Swabha Swayamdipta, Laura Vianna +3

cs.AI2010

Products of Weighted Logic Programs

Shay B. Cohen, Robert J. Simmons, Noah A. Smith