papers

Publications (67)

cs.CL2015

Learning Dynamic Feature Selection for Fast Sequential Prediction

Emma Strubell, Luke Vilnis, Kate Silverstein +1

cs.CL2025

Collage: Decomposable Rapid Prototyping for Information Extraction on Scientific PDFs

Sireesh Gururaja, Yueheng Zhang, Guannan Tang +6

cs.CL2019

The Materials Science Procedural Text Corpus: Annotating Materials Synthesis Procedures with Shallow Semantic Structures

Sheshera Mysore, Zach Jensen, Edward Kim +6

cs.CL2024

Just CHOP: Embarrassingly Simple LLM Compression

Ananya Harsh Jha, Tom Sherborne, Evan Pete Walsh +3

cs.CL2024

AboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters

Li Lucy, Suchin Gururangan, Luca Soldaini +4

cs.CL2017

Dependency Parsing with Dilated Iterated Graph CNNs

Emma Strubell, Andrew McCallum

cs.CL2023

Understanding the Effect of Model Compression on Social Bias in Large Language Models

Gustavo Gonçalves, Emma Strubell

cs.CL2018

Linguistically-Informed Self-Attention for Semantic Role Labeling

Emma Strubell, Patrick Verga, Daniel Andor +2

cs.CY2025

Misinformation by Omission: The Need for More Environmental Transparency in AI

Sasha Luccioni, Boris Gamazaychikov, Theo Alves da Costa +1

cs.NI2021

WiFiMod: Transformer-based Indoor Human Mobility Modeling using Passive Sensing

Amee Trivedi, Kate Silverstein, Emma Strubell +2

cs.LG2026

Evaluation of ML Resource Utilization Requires Model Life Cycle Assessment

Jared Fernandez, Clara Na, Yonatan Bisk +2

cs.SE2026

BlueFin: Benchmarking LLM Agents on Financial Spreadsheets

Srivatsa Kundurthy, Clara Na, Colton Moraine +6

cs.LG2023

The Framework Tax: Disparities Between Inference Efficiency in NLP Research and Deployment

Jared Fernandez, Jacob Kahn, Clara Na +2

cs.CL2023

Mention Annotations Alone Enable Efficient Domain Adaptation for Coreference Resolution

Nupoor Gandhi, Anjalie Field, Emma Strubell

cs.CV2023

Regularizing Self-training for Unsupervised Domain Adaptation via Structural Constraints

Rajshekhar Das, Jonathan Francis, Sanket Vaibhav Mehta +3

cs.CY2025

International AI Safety Report

Yoshua Bengio, Sören Mindermann, Daniel Privitera +93

cs.CL2019

Energy and Policy Considerations for Deep Learning in NLP

Emma Strubell, Ananya Ganesh, Andrew McCallum

cs.LG2025

Hardware Scaling Trends and Diminishing Returns in Large-Scale Distributed Training

Jared Fernandez, Luca Wehrstedt, Leonid Shamis +5

cs.DC2024

Carbon Connect: An Ecosystem for Sustainable Computing

Benjamin C. Lee, David Brooks, Arthur van Benthem +10

cs.LG2023

Making Scalable Meta Learning Practical

Sang Keun Choe, Sanket Vaibhav Mehta, Hwijeen Ahn +4

cs.CL2022

Train Flat, Then Compress: Sharpness-Aware Minimization Learns More Compressible Models

Clara Na, Sanket Vaibhav Mehta, Emma Strubell

cs.CL2025

Structured Extraction of Process Structure Properties Relationships in Materials Science

Amit K Verma, Zhisong Zhang, Junwon Seo +4

cs.CL2024

Source-Aware Training Enables Knowledge Attribution in Language Models

Muhammad Khalifa, David Wadden, Emma Strubell +4

cs.CL2024

Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research

Luca Soldaini, Rodney Kinney, Akshita Bhagia +33

cs.CL2025

Stereotype or Personalization? User Identity Biases Chatbot Recommendations

Anjali Kantharuban, Jeremiah Milbauer, Maarten Sap +2

cs.DC2026

The Energy Cost of Execution-Idle in GPU Clusters

Yiran Lei, Jared Fernandez, Vasilis Kypriotis +4

cs.CL2026

Task Decomposition for Efficient Annotation

Nupoor Gandhi, Emma Strubell

cs.CL2024

OLMo: Accelerating the Science of Language Models

Dirk Groeneveld, Iz Beltagy, Pete Walsh +40

cs.CL2016

Multilingual Relation Extraction using Compositional Universal Schema

Patrick Verga, David Belanger, Emma Strubell +2

cs.CL2022

Bridging Fairness and Environmental Sustainability in Natural Language Processing

Marius Hessenthaler, Emma Strubell, Dirk Hovy +1

cs.LG2025

Kinetics: Rethinking Test-Time Scaling Laws

Ranajoy Sadhukhan, Zhuoming Chen, Haizhong Zheng +3

eess.AS2025

On-device Streaming Discrete Speech Units

Kwanghee Choi, Masao Someki, Emma Strubell +1

cs.CL2023

Efficiency Pentathlon: A Standardized Arena for Efficiency Evaluation

Hao Peng, Qingqing Cao, Jesse Dodge +11

cs.CL2025

Energy Considerations of Large Language Model Inference and Efficiency Optimizations

Jared Fernandez, Clara Na, Vashisth Tiwari +3

cs.CL2023

Queer People are People First: Deconstructing Sexual Identity Stereotypes in Large Language Models

Harnoor Dhingra, Preetiha Jayashanker, Sayali Moghe +1

cs.CL2023

Efficient Methods for Natural Language Processing: A Survey

Marcos Treviso, Ji-Ung Lee, Tianchu Ji +19

cs.CL2023

A Survey of Active Learning for Natural Language Processing

Zhisong Zhang, Emma Strubell, Eduard Hovy

cs.LG2022

SQuAT: Sharpness- and Quantization-Aware Training for BERT

Zheng Wang, Juncheng B Li, Shuhui Qu +2

cs.LG2025

Expert Routing with Synthetic Data for Continual Learning

Yewon Byun, Sanket Vaibhav Mehta, Saurabh Garg +4

cs.CL2022

To Adapt or to Annotate: Challenges and Interventions for Domain Adaptation in Open-Domain Question Answering

Dheeru Dua, Emma Strubell, Sameer Singh +1

cs.LG2023

An Empirical Investigation of the Role of Pre-training in Lifelong Learning

Sanket Vaibhav Mehta, Darshan Patil, Sarath Chandar +1

cs.CL2026

FicSim: A Dataset for Multi-Faceted Semantic Similarity in Long-Form Fiction

Natasha Johnson, Amanda Bertsch, Maria-Emil Deal +1

cs.CY2025

Holistically Evaluating the Environmental Impact of Creating Language Models

Jacob Morrison, Clara Na, Jared Fernandez +3

cs.LG2024

Power Hungry Processing: Watts Driving the Cost of AI Deployment?

Alexandra Sasha Luccioni, Yacine Jernite, Emma Strubell

cond-mat.mtrl-sci2019

Inorganic Materials Synthesis Planning with Literature-Trained Neural Networks

Edward Kim, Zach Jensen, Alexander van Grootel +8

cs.CL2017

Automatically Extracting Action Graphs from Materials Science Synthesis Procedures

Sheshera Mysore, Edward Kim, Emma Strubell +6

cs.CL2018

Syntax Helps ELMo Understand Semantics: Is Syntax Still Relevant in a Deep Neural Architecture for SRL?

Emma Strubell, Andrew McCallum

cs.CL2017

Fast and Accurate Entity Recognition with Iterated Dilated Convolutions

Emma Strubell, Patrick Verga, David Belanger +1

cs.CL2014

Training for Fast Sequential Prediction Using Dynamic Feature Selection

Emma Strubell, Luke Vilnis, Andrew McCallum

cs.CY2025

From Efficiency Gains to Rebound Effects: The Problem of Jevons' Paradox in AI's Polarized Environmental Debate

Alexandra Sasha Luccioni, Emma Strubell, Kate Crawford

cs.LG2024

What is Your Data Worth to GPT? LLM-Scale Data Valuation with Influence Functions

Sang Keun Choe, Hwijeen Ahn, Juhan Bae +11

cs.CL2024

Scalable Data Ablation Approximations for Language Models through Modular Training and Merging

Clara Na, Ian Magnusson, Ananya Harsh Jha +4

cs.LG2022

Error-aware Quantization through Noise Tempering

Zheng Wang, Juncheng B Li, Shuhui Qu +2

cs.CL2026

SpreadsheetArena: Decomposing Preference in LLM Generation of Spreadsheet Workbooks

Srivatsa Kundurthy, Clara Na, Michael Handley +5

cs.CL2025

Beyond Text: Characterizing Domain Expert Needs in Document Research

Sireesh Gururaja, Nupoor Gandhi, Jeremiah Milbauer +1

cs.CL2023

Data-efficient Active Learning for Structured Prediction with Partial Annotation and Self-Training

Zhisong Zhang, Emma Strubell, Eduard Hovy

cs.LG2022

Measuring the Carbon Intensity of AI in Cloud Instances

Jesse Dodge, Taylor Prewitt, Remi Tachet Des Combes +7

cs.AR2025

Empirically-Calibrated H100 Node Power Models for Reducing Uncertainty in AI Training Energy Estimation

Alex C. Newkirk, Jared Fernandez, Jonathan Koomey +4

cs.CL2023

To Build Our Future, We Must Know Our Past: Contextualizing Paradigm Shifts in Natural Language Processing

Sireesh Gururaja, Amanda Bertsch, Clara Na +2

cs.CL2024

Energy and Carbon Considerations of Fine-Tuning BERT

Xiaorong Wang, Clara Na, Emma Strubell +2

cs.CY2026

The Hidden Cost of Thinking: Energy Use and Environmental Impact of LMs Beyond Pretraining

Jacob Morrison, Noah A. Smith, Emma Strubell

cs.CL2023

DSI++: Updating Transformer Memory with New Documents

Sanket Vaibhav Mehta, Jai Gupta, Yi Tay +6

cs.CL2017

Attending to All Mention Pairs for Full Abstract Biological Relation Extraction

Patrick Verga, Emma Strubell, Ofer Shai +1

cs.CL2018

Simultaneously Self-Attending to All Mentions for Full-Abstract Biological Relation Extraction

Patrick Verga, Emma Strubell, Andrew McCallum

cs.CL2022

Improving Compositional Generalization with Self-Training for Data-to-Text Generation

Sanket Vaibhav Mehta, Jinfeng Rao, Yi Tay +3

cs.CL2024

Gradient Localization Improves Lifelong Pretraining of Language Models

Jared Fernandez, Yonatan Bisk, Emma Strubell

cs.CL2023

Surveying (Dis)Parities and Concerns of Compute Hungry NLP Research

Ji-Ung Lee, Haritz Puerto, Betty van Aken +8