Publications (239)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
Weijia Shi, Jaechan Lee, Yangsibo Huang +7
RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models
Samuel Gehman, Suchin Gururangan, Maarten Sap +2
Elaboration-Generating Commonsense Question Answering at Scale
Wenya Wang, Vivek Srikumar, Hanna Hajishirzi +1
Whose Language Counts as High Quality? Measuring Language Ideologies in Text Data Selection
Suchin Gururangan, Dallas Card, Sarah K. Dreier +5
Tulu 3: Pushing Frontiers in Open Language Model Post-Training
Nathan Lambert, Jacob Morrison, Valentina Pyatkin +20
Time Waits for No One! Analysis and Challenges of Temporal Misalignment
Kelvin Luu, Daniel Khashabi, Suchin Gururangan +2
Training with Exploration Improves a Greedy Stack-LSTM Parser
Miguel Ballesteros, Yoav Goldberg, Chris Dyer +1
RealTime QA: What's the Answer Right Now?
Jungo Kasai, Keisuke Sakaguchi, Yoichi Takahashi +7
LSTMs Exploit Linguistic Attributes of Data
Nelson F. Liu, Omer Levy, Roy Schwartz +2
To Tune or Not to Tune? Adapting Pretrained Representations to Diverse Tasks
Matthew E. Peters, Sebastian Ruder, Noah A. Smith
Polyglot Contextual Representations Improve Crosslingual Transfer
Phoebe Mulcaire, Jungo Kasai, Noah A. Smith
How Much Does Attention Actually Attend? Questioning the Importance of Attention in Pretrained Transformers
Michael Hassid, Hao Peng, Daniel Rotem +4
MMMG: a Comprehensive and Reliable Evaluation Suite for Multitask Multimodal Generation
Jihan Yao, Yushi Hu, Yujie Yi +9
Contextual Word Representations: A Contextual Introduction
Noah A. Smith
Evaluating Gender Bias in Machine Translation
Gabriel Stanovsky, Noah A. Smith, Luke Zettlemoyer
Bolmo: Byteifying the Next Generation of Language Models
Benjamin Minixhofer, Tyler Murray, Tomasz Limisiewicz +6
Grounded Compositional Outputs for Adaptive Language Modeling
Nikolaos Pappas, Phoebe Mulcaire, Noah A. Smith
A Dataset of Information-Seeking Questions and Answers Anchored in Research Papers
Pradeep Dasigi, Kyle Lo, Iz Beltagy +3
How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources
Yizhong Wang, Hamish Ivison, Pradeep Dasigi +8
Sample, Don't Search: Rethinking Test-Time Alignment for Language Models
Gonçalo Faria, Noah A. Smith
Distilling an Ensemble of Greedy Dependency Parsers into One MST Parser
Adhiguna Kuncoro, Miguel Ballesteros, Lingpeng Kong +2
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
Rahul Nadkarni, Yanai Elazar, Hila Gonen +1
Segmental Recurrent Neural Networks
Lingpeng Kong, Chris Dyer, Noah A. Smith
Olmo Hybrid: From Theory to Practice and Back
William Merrill, Yanhong Li, Tyler Romero +19
FlexOlmo: Open Language Models for Flexible Data Use
Weijia Shi, Akshita Bhagia, Kevin Farhat +20
Summarization-Based Document IDs for Generative Retrieval with Language Models
Haoxin Li, Daniel Cheng, Phillip Keung +2
Super-NaturalInstructions: Generalization via Declarative Instructions on 1600+ NLP Tasks
Yizhong Wang, Swaroop Mishra, Pegah Alipoormolabashi +37
LEGATO: Large-scale End-to-end Generalizable Approach to Typeset OMR
Guang Yang, Victoria Ebert, Nazif Tamer +3
Improving Natural Language Inference with a Pretrained Parser
Deric Pang, Lucy H. Lin, Noah A. Smith
Reading Between the Lines: The One-Sided Conversation Problem
Victoria Ebert, Rishabh Singh, Tuochao Chen +2
Self-Instruct: Aligning Language Models with Self-Generated Instructions
Yizhong Wang, Yeganeh Kordi, Swaroop Mishra +4
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
Orevaoghene Ahia, Anuoluwapo Aremu, Diana Abagyan +5
Retrofitting Word Vectors to Semantic Lexicons
Manaal Faruqui, Jesse Dodge, Sujay K. Jauhar +3
Unsupervised Bitext Mining and Translation via Self-trained Contextual Embeddings
Phillip Keung, Julian Salazar, Yichao Lu +1
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
Min Jang, Orevaoghene Ahia, Nazif Tamer +3
Annotation Artifacts in Natural Language Inference Data
Suchin Gururangan, Swabha Swayamdipta, Omer Levy +3
SuperBPE: Space Travel for Language Models
Alisa Liu, Jonathan Hayase, Valentin Hofmann +3
Backpropagating through Structured Argmax using a SPIGOT
Hao Peng, Sam Thomson, Noah A. Smith
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
Terra Blevins, Tomasz Limisiewicz, Suchin Gururangan +4
End-to-End Neural Segmental Models for Speech Recognition
Hao Tang, Liang Lu, Lingpeng Kong +5
How Performance Pressure Influences AI-Assisted Decision Making
Nikita Haduong, Noah A. Smith
Improved Transition-Based Parsing by Modeling Characters instead of Words with LSTMs
Miguel Ballesteros, Chris Dyer, Noah A. Smith
Transparency Helps Reveal When Language Models Learn Meaning
Zhaofeng Wu, William Merrill, Hao Peng +2
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
Jacob Morrison, Noah A. Smith, Hannaneh Hajishirzi +3
Data-Efficient Finetuning Using Cross-Task Nearest Neighbors
Hamish Ivison, Noah A. Smith, Hannaneh Hajishirzi +1
Annotating Character Relationships in Literary Texts
Philip Massey, Patrick Xia, David Bamman +1
Predicting the NFL using Twitter
Shiladitya Sinha, Chris Dyer, Kevin Gimpel +1
Fluid Language Model Benchmarking
Valentin Hofmann, David Heineman, Ian Magnusson +7
PaLM: A Hybrid Parser and Language Model
Hao Peng, Roy Schwartz, Noah A. Smith
What Do Recurrent Neural Network Grammars Learn About Syntax?
Adhiguna Kuncoro, Miguel Ballesteros, Lingpeng Kong +3
On Linear Representations and Pretraining Data Frequency in Language Models
Jack Merullo, Noah A. Smith, Sarah Wiegreffe +1
Estimating the Causal Effect of Early ArXiving on Paper Acceptance
Yanai Elazar, Jiayao Zhang, David Wadden +2
BLAB: Brutally Long Audio Bench
Orevaoghene Ahia, Martijn Bartelds, Kabir Ahuja +13
Evaluating $n$-Gram Novelty of Language Models Using Rusty-DAWG
William Merrill, Noah A. Smith, Yanai Elazar
Efficient Encoder-Decoder Transformer Decoding for Decomposable Tasks
Bo-Ru Lu, Nikita Haduong, Chien-Yu Lin +3
Finetuning Pretrained Transformers into RNNs
Jungo Kasai, Hao Peng, Yizhe Zhang +6
Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models
Matt Deitke, Christopher Clark, Sangho Lee +47
Encode Once, Decode Never: Reusing Audio LM Internals for Efficient Temporal Localization
Joesph An, Joseph An, Phillip Keung +3
Tuning Language Models by Proxy
Alisa Liu, Xiaochuang Han, Yizhong Wang +3
Inferring Social Rank in an Old Assyrian Trade Network
David Bamman, Adam Anderson, Noah A. Smith
Establishing Task Scaling Laws via Compute-Efficient Model Ladders
Akshita Bhagia, Jiacheng Liu, Alexander Wettig +9
The Multilingual Amazon Reviews Corpus
Phillip Keung, Yichao Lu, György Szarvas +1
Unsupervised Learning of Hierarchical Conversation Structure
Bo-Ru Lu, Yushi Hu, Hao Cheng +2
Evaluating Copyright Takedown Methods for Language Models
Boyi Wei, Weijia Shi, Yangsibo Huang +5
Camels in a Changing Climate: Enhancing LM Adaptation with Tulu 2
Hamish Ivison, Yizhong Wang, Valentina Pyatkin +8
Parsing with Multilingual BERT, a Small Corpus, and a Small Treebank
Ethan C. Chau, Lucy H. Lin, Noah A. Smith
Topics to Avoid: Demoting Latent Confounds in Text Classification
Sachin Kumar, Shuly Wintner, Noah A. Smith +1
Learning Joint Semantic Parsers from Disjoint Data
Hao Peng, Sam Thomson, Swabha Swayamdipta +1
Fine-Grained Human Feedback Gives Better Rewards for Language Model Training
Zeqiu Wu, Yushi Hu, Weijia Shi +6
Unpacking DPO and PPO: Disentangling Best Practices for Learning from Preference Feedback
Hamish Ivison, Yizhong Wang, Jiacheng Liu +6
Olmo 3
Team Olmo, :, Allyson Ettinger +66
Character Sequence Models for ColorfulWords
Kazuya Kawakami, Chris Dyer, Bryan R. Routledge +1
The Leaderboard Illusion
Shivalika Singh, Yiyang Nan, Alex Wang +10
DEMix Layers: Disentangling Domains for Modular Language Modeling
Suchin Gururangan, Mike Lewis, Ari Holtzman +2
On Consequentialism and Fairness
Dallas Card, Noah A. Smith
Challenges in Automated Debiasing for Toxic Language Detection
Xuhui Zhou, Maarten Sap, Swabha Swayamdipta +2
Rational Recurrences
Hao Peng, Roy Schwartz, Sam Thomson +1
Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation
Ofir Press, Noah A. Smith, Mike Lewis
NarrowBERT: Accelerating Masked Language Model Pretraining and Inference
Haoxin Li, Phillip Keung, Daniel Cheng +2
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
Brian Siyuan Zheng, Alisa Liu, Orevaoghene Ahia +3
We're Afraid Language Models Aren't Modeling Ambiguity
Alisa Liu, Zhaofeng Wu, Julian Michael +6
The Effect of Different Writing Tasks on Linguistic Style: A Case Study of the ROC Story Cloze Task
Roy Schwartz, Maarten Sap, Ioannis Konstas +3
Friendships, Rivalries, and Trysts: Characterizing Relations between Ideas in Texts
Chenhao Tan, Dallas Card, Noah A. Smith
Language Models: A Guide for the Perplexed
Sofia Serrano, Zander Brumbaugh, Noah A. Smith
Measuring and Narrowing the Compositionality Gap in Language Models
Ofir Press, Muru Zhang, Sewon Min +3
Massively Multilingual Word Embeddings
Waleed Ammar, George Mulcaire, Yulia Tsvetkov +3
Beyond One Output: Visualizing and Comparing Distributions of Language Model Generations
Emily Reif, Claire Yang, Jared Hwang +3
Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models
Orevaoghene Ahia, Sachin Kumar, Hila Gonen +4
Domain Mismatch Doesn't Always Prevent Cross-Lingual Transfer Learning
Daniel Edmiston, Phillip Keung, Noah A. Smith
Quoref: A Reading Comprehension Dataset with Questions Requiring Coreferential Reasoning
Pradeep Dasigi, Nelson F. Liu, Ana MarasoviÄ +2
Greedy, Joint Syntactic-Semantic Parsing with Stack LSTMs
Swabha Swayamdipta, Miguel Ballesteros, Chris Dyer +1
Know Your Audience: The benefits and pitfalls of generating plain language summaries beyond the "general" audience
Tal August, Kyle Lo, Noah A. Smith +1
New Alignment Methods for Discriminative Book Summarization
David Bamman, Noah A. Smith
Hybrid Preferences: Learning to Route Instances for Human vs. AI Feedback
Lester James V. Miranda, Yizhong Wang, Yanai Elazar +6
Situating Sentence Embedders with Nearest Neighbor Overlap
Lucy H. Lin, Noah A. Smith
Stubborn Lexical Bias in Data and Models
Sofia Serrano, Jesse Dodge, Noah A. Smith
Saturated Transformers are Constant-Depth Threshold Circuits
William Merrill, Ashish Sabharwal, Noah A. Smith
Morphosyntactic probing of multilingual BERT models
Judit Acs, Endre Hamerlik, Roy Schwartz +2
Annotators with Attitudes: How Annotator Beliefs And Identities Bias Toxic Language Detection
Maarten Sap, Swabha Swayamdipta, Laura Vianna +3
Products of Weighted Logic Programs
Shay B. Cohen, Robert J. Simmons, Noah A. Smith