Publications (78)
Generating Synthetic Text Data to Evaluate Causal Inference Methods
Zach Wood-Doughty, Ilya Shpitser, Mark Dredze
Harmonic Grammar, Optimality Theory, and Syntax Learnability: An Empirical Exploration of Czech Word Order
Ann Irvine, Mark Dredze
How to Interpret Agent Behavior
Jie Gao, Kaiser Sun, Jen-tse Huang +8
Schema-Driven Information Extraction from Heterogeneous Tables
Fan Bai, Junmo Kang, Gabriel Stanovsky +3
Phenotyping of Clinical Notes with Improved Document Classification Models Using Contextualized Neural Language Models
Andriy Mulyar, Elliot Schumacher, Masoud Rouhizadeh +1
Understanding and Mitigating Risks of Generative AI in Financial Services
Sebastian Gehrmann, Claire Huang, Xian Teng +9
On the Failure of Latent State Persistence in Large Language Models
Jen-tse Huang, Kaiser Sun, Wenxuan Wang +1
Knowing But Not Doing: Convergent Morality and Divergent Action in LLMs
Jen-tse Huang, Jiantong Qin, Xueli Qiu +3
Can Optimization Trajectories Explain Multi-Task Transfer?
David Mueller, Mark Dredze, Nicholas Andrews
The Twitter Social Mobility Index: Measuring Social Distancing Practices from Geolocated Tweets
Paiheng Xu, Mark Dredze, David A. Broniatowski
Beto, Bentz, Becas: The Surprising Cross-Lingual Effectiveness of BERT
Shijie Wu, Mark Dredze
MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies
Shiyue Zhang, Shijie Wu, Ozan Irsoy +4
What Makes Data-to-Text Generation Hard for Pretrained Language Models?
Moniba Keymanesh, Adrian Benton, Mark Dredze
Feature Generation for Robust Semantic Role Labeling
Travis Wolfe, Mark Dredze, Benjamin Van Durme
RAG LLMs are Not Safer: A Safety Analysis of Retrieval-Augmented Generation for Large Language Models
Bang An, Shiyue Zhang, Mark Dredze
Can one size fit all?: Measuring Failure in Multi-Document Summarization Domain Transfer
Alexandra DeLucia, Mark Dredze
Are Clinical T5 Models Better for Clinical Text?
Yahan Li, Keith Harrigian, Ayah Zirikly +1
Gender Bias in Decision-Making with Large Language Models: A Study of Relationship Conflicts
Sharon Levy, William D. Adler, Tahilin Sanchez Karver +2
Combining Search, Social Media, and Traditional Data Sources to Improve Influenza Surveillance
Mauricio Santillana, Andre T. Nguyen, Mark Dredze +2
Faithful and Plausible Explanations of Medical Code Predictions
Zach Wood-Doughty, Isabel Cachola, Mark Dredze
Evaluating Biases in Context-Dependent Health Questions
Sharon Levy, Tahilin Sanchez Karver, William D. Adler +2
Challenges of Using Text Classifiers for Causal Inference
Zach Wood-Doughty, Ilya Shpitser, Mark Dredze
Do Text-to-Text Multi-Task Learners Suffer from Task Conflict?
David Mueller, Nicholas Andrews, Mark Dredze
User Factor Adaptation for User Embedding via Multitask Learning
Xiaolei Huang, Michael J. Paul, Robin Burke +2
Using Noisy Self-Reports to Predict Twitter User Demographics
Zach Wood-Doughty, Paiheng Xu, Xiao Liu +1
Sources of Transfer in Multilingual Named Entity Recognition
David Mueller, Nicholas Andrews, Mark Dredze
DnDScore: Decontextualization and Decomposition for Factuality Verification in Long-Form Text Generation
Miriam Wanner, Benjamin Van Durme, Mark Dredze
On the State of Social Media Data for Mental Health Research
Keith Harrigian, Carlos Aguirre, Mark Dredze
Twitter and Facebook posts about COVID-19 are less likely to spread false and low-credibility content compared to other health topics
David A. Broniatowski, Daniel Kerchner, Fouzia Farooq +4
Fine-tuning Encoders for Improved Monolingual and Zero-shot Polylingual Neural Topic Modeling
Aaron Mueller, Mark Dredze
MedScore: Generalizable Factuality Evaluation of Free-Form Medical Answers by Domain-adapted Claim Decomposition and Verification
Heyuan Huang, Alexandra DeLucia, Vijay Murari Tiyyala +1
FIRE-Bench: Evaluating AI Agents on the Rediscovery of Scientific Insights
Zhen Wang, Fan Bai, Zhongyan Luo +9
Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles
Fatima Jahara, Mark Dredze, Sharon Levy
Demographic Representation and Collective Storytelling in the Me Too Twitter Hashtag Activism Movement
Aaron Mueller, Zach Wood-Doughty, Silvio Amir +2
Then and Now: Quantifying the Longitudinal Validity of Self-Disclosed Depression Diagnoses
Keith Harrigian, Mark Dredze
Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict
Kaiser Sun, Fan Bai, Mark Dredze
Efficiency with Rigor! A Trustworthy LLM-powered Workflow for Qualitative Data Analysis
Jie Gao, Zhiyao Shu, Shun Yi Yeo +4
Enriching Unsupervised User Embedding via Medical Concepts
Xiaolei Huang, Franck Dernoncourt, Mark Dredze
Improving Named Entity Recognition for Chinese Social Media with Word Segmentation Representation Learning
Nanyun Peng, Mark Dredze
Amuro and Char: Analyzing the Relationship between Pre-Training and Fine-Tuning of Large Language Models
Kaiser Sun, Mark Dredze
Transferring Fairness using Multi-Task Learning with Limited Demographic Information
Carlos Aguirre, Mark Dredze
Visual Attention Model for Cross-sectional Stock Return Prediction and End-to-End Multimodal Market Representation Learning
Ran Zhao, Yuntian Deng, Mark Dredze +3
Approximation-Aware Dependency Parsing by Belief Propagation
Matthew R. Gormley, Mark Dredze, Jason Eisner
Using Open-Ended Stressor Responses to Predict Depressive Symptoms across Demographics
Carlos Aguirre, Mark Dredze, Philip Resnik
Reading, Not Thinking: Understanding and Bridging the Modality Gap When Text Becomes Pixels in Multimodal LLMs
Kaiser Sun, Xiaochuang Yuan, Hongjun Liu +4
Gender and Racial Fairness in Depression Research using Social Media
Carlos Aguirre, Keith Harrigian, Mark Dredze
Twitter as a Source of Global Mobility Patterns for Social Good
Mark Dredze, Manuel GarcÃa-Herranz, Alex Rutherford +1
Cross-Lingual Transfer in Zero-Shot Cross-Language Entity Linking
Elliot Schumacher, James Mayfield, Mark Dredze
Everything Is All It Takes: A Multipronged Strategy for Zero-Shot Cross-Lingual Information Extraction
Mahsa Yarmohammadi, Shijie Wu, Marc Marone +10
Artificial Intolerance: Stigmatizing Language in Clinical Documentation Skews Large Language Model Decision-Making
Jen-tse Huang, Didi Zhou, Faith Kamau +5
Using large language models to promote health equity
Emma Pierson, Divya Shanmugam, Rajiv Movva +12
Do Explicit Alignments Robustly Improve Multilingual Encoders?
Shijie Wu, Mark Dredze
Can Big Media Data Revolutionarize Gun Violence Prevention?
John W. Ayers, Benjamin M. Althouse, Eric C. Leas +2
Selecting Shots for Demographic Fairness in Few-Shot Learning with Large Language Models
Carlos Aguirre, Kuleen Sasse, Isabel Cachola +1
Same Verdict, Different Reasons: LLM-as-a-Judge and Clinician Disagreement on Medical Chatbot Completeness
Alexandra DeLucia, Heyuan Huang, Sonal Joshi +3
Probing Multimodal Large Language Models on Cognitive Biases in Chinese Short-Video Misinformation
Jen-tse Huang, Chang Chen, Shiyang Lai +3
LLMs are Better Than You Think: Label-Guided In-Context Learning for Named Entity Recognition
Fan Bai, Hamid Hassanzadeh, Ardavan Saeedi +1
The Problem of Semantic Shift in Longitudinal Monitoring of Social Media: A Case Study on Mental Health During the COVID-19 Pandemic
Keith Harrigian, Mark Dredze
Improving Zero-Shot Multi-Lingual Entity Linking
Elliot Schumacher, James Mayfield, Mark Dredze
Evaluating the Evaluators: Are readability metrics good measures of readability?
Isabel Cachola, Daniel Khashabi, Mark Dredze
Making FETCH! Happen: Finding Emergent Dog Whistles Through Common Habitats
Kuleen Sasse, Carlos Aguirre, Isabel Cachola +2
Embedding Lexical Features via Low-Rank Tensors
Mo Yu, Mark Dredze, Raman Arora +1
Learning to Look Inside: Augmenting Token-Based Encoders with Character-Level Information
Yuval Pinter, Amanda Stent, Mark Dredze +1
Examining the Feasibility of Off-the-Shelf Algorithms for Masking Directly Identifiable Information in Social Media Data
Rachel Dorn, Alicia L. Nobles, Masoud Rouhizadeh +1
Interactive Knowledge Base Population
Travis Wolfe, Mark Dredze, James Mayfield +4
Improved Relation Extraction with Feature-Rich Compositional Embedding Models
Matthew R. Gormley, Mo Yu, Mark Dredze
Are All Languages Created Equal in Multilingual BERT?
Shijie Wu, Mark Dredze
BloombergGPT: A Large Language Model for Finance
Shijie Wu, Ozan Irsoy, Steven Lu +6
Multi-task Domain Adaptation for Sequence Tagging
Nanyun Peng, Mark Dredze
Weird Generalization is Weirdly Brittle
Miriam Wanner, Hannah Collison, William Jurayj +3
Demo: Statistically Significant Results On Biases and Errors of LLMs Do Not Guarantee Generalizable Results
Jonathan Liu, Haoling Qiu, Jonathan Lasko +3
Benchmarking Large Language Models on Answering and Explaining Challenging Medical Questions
Hanjie Chen, Zhouxiang Fang, Yash Singla +1
Give me Some Hard Questions: Synthetic Data Generation for Clinical QA
Fan Bai, Keith Harrigian, Joel Stremmel +3
A Closer Look at Claim Decomposition
Miriam Wanner, Seth Ebner, Zhengping Jiang +2
After Sandy Hook Elementary: A Year in the Gun Control Debate on Twitter
Adrian Benton, Braden Hancock, Glen Coppersmith +2
Zero-shot Cross-lingual Transfer is Under-specified Optimization
Shijie Wu, Benjamin Van Durme, Mark Dredze
Estimating Confusions in the ASR Channel for Improved Topic-based Language Model Adaptation
Damianos Karakos, Mark Dredze, Sanjeev Khudanpur
An Eye on Clinical BERT: Investigating Language Model Generalization for Diabetic Eye Disease Phenotyping
Keith Harrigian, Tina Tang, Anthony Gonzales +2