papers

Publications (127)

cs.LG2026

Continuous Diffusion Models Can Obey Formal Syntax

Jinwoo Kim, Taylor Berg-Kirkpatrick, Loris D'Antoni

cs.NE2017

Improved Variational Autoencoders for Text Modeling using Dilated Convolutions

Zichao Yang, Zhiting Hu, Ruslan Salakhutdinov +1

cs.CL2021

Truth-Conditional Captioning of Time Series Data

Harsh Jhamtani, Taylor Berg-Kirkpatrick

cs.CL2026

From sunblock to softblock: Analyzing the correlates of neology in published writing and on social media

Maria Ryskina, Matthew R. Gormley, Kyle Mahowald +3

cs.CL2019

Unsupervised Text Style Transfer using Language Models as Discriminators

Zichao Yang, Zhiting Hu, Chris Dyer +2

cs.SD2023

Universal Source Separation with Weakly Labelled Data

Qiuqiang Kong, Ke Chen, Haohe Liu +4

cs.CL2022

Towards a Unified View of Parameter-Efficient Transfer Learning

Junxian He, Chunting Zhou, Xuezhe Ma +2

cs.CL2026

Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs

Xin Gao, Cheng Yang, Chufan Shi +1

cs.CV2024

TeaserGen: Generating Teasers for Long Documentaries

Weihan Xu, Paul Pu Liang, Haven Kim +3

cs.CL2017

Identifying Products in Online Cybercrime Marketplaces: A Dataset for Fine-grained Domain Adaptation

Greg Durrett, Jonathan K. Kummerfeld, Taylor Berg-Kirkpatrick +5

cs.LG2020

A Probabilistic Generative Model for Typographical Analysis of Early Modern Printing

Kartik Goyal, Chris Dyer, Christopher Warren +2

cs.SD2026

Bob's Confetti: Phonetic Memorization Attacks in Music and Video Generation

Jaechul Roh, Zachary Novack, Yuefeng Peng +3

cs.LG2025

ClimaQA: An Automated Evaluation Framework for Climate Question Answering Models

Veeramakali Vignesh Manivannan, Yasaman Jafari, Srikar Eranky +6

cs.CV2021

Neural Representation Learning for Scribal Hands of Linear B

Nikita Srivatsan, Jason Vega, Christina Skelton +1

cs.LG2022

Exposing the Implicit Energy Networks behind Masked Language Models via Metropolis--Hastings

Kartik Goyal, Chris Dyer, Taylor Berg-Kirkpatrick

cs.SD2023

Towards Improving Harmonic Sensitivity and Prediction Stability for Singing Melody Extraction

Keren Shao, Ke Chen, Taylor Berg-Kirkpatrick +1

cs.LG2017

A Continuous Relaxation of Beam Search for End-to-end Training of Neural Sequence Models

Kartik Goyal, Graham Neubig, Chris Dyer +1

cs.CL2020

Narrative Text Generation with a Latent Discrete Plan

Harsh Jhamtani, Taylor Berg-Kirkpatrick

cs.LG2020

Modeling Online Discourse with Coupled Distributed Topics

Nikita Srivatsan, Zachary Wojtowicz, Taylor Berg-Kirkpatrick

cs.AI2025

Grammar-Aligned Decoding

Kanghee Park, Jiayu Wang, Taylor Berg-Kirkpatrick +2

cs.SD2021

Towards Automatic Instrumentation by Learning to Separate Parts in Symbolic Multitrack Music

Hao-Wen Dong, Chris Donahue, Taylor Berg-Kirkpatrick +1

cs.CL2021

Comparative Error Analysis in Neural and Finite-state Models for Unsupervised Character-level Transduction

Maria Ryskina, Eduard Hovy, Taylor Berg-Kirkpatrick +1

cs.CV2018

Using Syntax to Ground Referring Expressions in Natural Images

Volkan Cirik, Taylor Berg-Kirkpatrick, Louis-Philippe Morency

eess.AS2022

TONet: Tone-Octave Network for Singing Melody Extraction from Polyphonic Music

Ke Chen, Shuai Yu, Cheng-i Wang +3

cs.CL2021

An Empirical Study of Extrapolation in Text Generation with Scalar Control

Aashi Jain, Taylor Berg-Kirkpatrick

cs.CV2025

REGen: Multimodal Retrieval-Embedded Generation for Long-to-Short Video Editing

Weihan Xu, Yimeng Ma, Jingyue Huang +6

cs.CV2021

Lacuna Reconstruction: Self-supervised Pre-training for Low-Resource Historical Document Transcription

Nikolai Vogler, Jonathan Parkes Allen, Matthew Thomas Miller +1

cs.CL2020

A Bilingual Generative Transformer for Semantic Sentence Embedding

John Wieting, Graham Neubig, Taylor Berg-Kirkpatrick

cs.CL2023

Beyond Contrastive Learning: A Variational Generative Model for Multilingual Retrieval

John Wieting, Jonathan H. Clark, William W. Cohen +2

cs.CL2025

Single-Pass Document Scanning for Question Answering

Weili Cao, Jianyou Wang, Youze Zheng +5

cs.CL2023

Non-Parametric Temporal Adaptation for Social Media Topic Classification

Fatemehsadat Mireshghallah, Nikolai Vogler, Junxian He +3

cs.CL2021

Investigating Robustness of Dialog Models to Popular Figurative Language Constructs

Harsh Jhamtani, Varun Gangal, Eduard Hovy +1

cs.CL2021

Efficient Nearest Neighbor Language Models

Junxian He, Graham Neubig, Taylor Berg-Kirkpatrick

cs.CL2018

Visual Referring Expression Recognition: What Do Systems Actually Learn?

Volkan Cirik, Louis-Philippe Morency, Taylor Berg-Kirkpatrick

cs.CL2026

The Format Tax

Ivan Yee Lee, Loris D'Antoni, Taylor Berg-Kirkpatrick

cs.LG2021

Privacy Regularization: Joint Privacy-Utility Optimization in Language Models

Fatemehsadat Mireshghallah, Huseyin A. Inan, Marcello Hasegawa +3

cs.CL2020

A Probabilistic Formulation of Unsupervised Text Style Transfer

Junxian He, Xinyi Wang, Graham Neubig +1

cs.CL2026

Translation or Recitation? Calibrating Evaluation Scores for Machine Translation of Extremely Low-Resource Languages

Danlu Chen, Ka Sing He, Jiahe Tian +4

cs.CL2022

Mix and Match: Learning-free Controllable Text Generation using Energy Language Models

Fatemehsadat Mireshghallah, Kartik Goyal, Taylor Berg-Kirkpatrick

cs.LG2020

Music SketchNet: Controllable Music Generation via Factorized Representations of Pitch and Rhythm

Ke Chen, Cheng-i Wang, Taylor Berg-Kirkpatrick +1

cs.SD2025

Fast Text-to-Audio Generation with Adversarial Post-Training

Zachary Novack, Zach Evans, Zack Zukowski +8

cs.SD2020

MusPy: A Toolkit for Symbolic Music Generation

Hao-Wen Dong, Ke Chen, Julian McAuley +1

cs.LG2019

A Surprisingly Effective Fix for Deep Latent Variable Modeling of Text

Bohan Li, Junxian He, Graham Neubig +2

cs.SD2023

Multitrack Music Transformer

Hao-Wen Dong, Ke Chen, Shlomo Dubnov +2

cs.SD2024

DITTO-2: Distilled Diffusion Inference-Time T-Optimization for Music Generation

Zachary Novack, Julian McAuley, Taylor Berg-Kirkpatrick +1

cs.SD2023

Unsupervised Lead Sheet Generation via Semantic Compression

Zachary Novack, Nikita Srivatsan, Taylor Berg-Kirkpatrick +1

cs.CL2023

Membership Inference Attacks against Language Models via Neighbourhood Comparison

Justus Mattern, Fatemehsadat Mireshghallah, Zhijing Jin +3

cs.CL2026

LogogramNLP: Comparing Visual and Textual Representations of Ancient Logographic Writing Systems for NLP

Danlu Chen, Freda Shi, Aditi Agarwal +2

cs.CL2018

Learning to Describe Differences Between Pairs of Similar Images

Harsh Jhamtani, Taylor Berg-Kirkpatrick

cs.CV2024

Alt-Text with Context: Improving Accessibility for Images on Twitter

Nikita Srivatsan, Sofia Samaniego, Omar Florez +1

cs.SD2022

Zero-shot Audio Source Separation through Query-based Learning from Weakly-labeled Data

Ke Chen, Xingjian Du, Bilei Zhu +3

cs.DL2024

Clustering Running Titles to Understand the Printing of Early Modern Books

Nikolai Vogler, Kartik Goyal, Samuel V. Lemley +4

cs.AI2025

Constrained Sampling for Language Models Should Be Easy: An MCMC Perspective

Emmanuel Anaya Gonzalez, Sairam Vaidya, Kanghee Park +3

cs.CV2021

Scalable Font Reconstruction with Dual Latent Manifolds

Nikita Srivatsan, Si Wu, Jonathan T. Barron +1

cs.SD2025

Are you really listening? Boosting Perceptual Awareness in Music-QA Benchmarks

Yongyi Zang, Sean O'Brien, Taylor Berg-Kirkpatrick +2

cs.SD2026

BACHI: Boundary-Aware Symbolic Chord Recognition Through Masked Iterative Decoding on Pop and Classical Music

Mingyang Yao, Ke Chen, Shlomo Dubnov +1

cs.CV2023

Contrastive Attention Networks for Attribution of Early Modern Print

Nikolai Vogler, Kartik Goyal, Kishore PV Reddy +5

cs.CL2020

Learning Sparse Prototypes for Text Generation

Junxian He, Taylor Berg-Kirkpatrick, Graham Neubig

cs.CL2019

Learning Rhyming Constraints using Structured Adversaries

Harsh Jhamtani, Sanket Vaibhav Mehta, Jaime Carbonell +1

cs.LG2022

UserIdentifier: Implicit User Representations for Simple and Effective Personalized Sentiment Analysis

Fatemehsadat Mireshghallah, Vaishnavi Shrivastava, Milad Shokouhi +3

cs.LG2020

A Deep Factorization of Style and Structure in Fonts

Nikita Srivatsan, Jonathan T. Barron, Dan Klein +1

cs.SD2024

Improving Generalization of Speech Separation in Real-World Scenarios: Strategies in Simulation, Optimization, and Evaluation

Ke Chen, Jiaqi Su, Taylor Berg-Kirkpatrick +2

cs.CV2018

Speaker-Follower Models for Vision-and-Language Navigation

Daniel Fried, Ronghang Hu, Volkan Cirik +7

cs.CV2026

Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination

Chufan Shi, Cheng Yang, Yaokang Wu +4

cs.LG2022

Quantifying Privacy Risks of Masked Language Models Using Membership Inference Attacks

Fatemehsadat Mireshghallah, Kartik Goyal, Archit Uniyal +2

cs.SD2023

MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies

Ke Chen, Yusong Wu, Haohe Liu +3

cs.CL2016

Learning-Based Single-Document Summarization with Compression and Anaphoricity Constraints

Greg Durrett, Taylor Berg-Kirkpatrick, Dan Klein

cs.CV2021

An Empirical Evaluation of End-to-End Polyphonic Optical Music Recognition

Sachinda Edirisooriya, Hao-Wen Dong, Julian McAuley +1

cs.SD2025

Generating Symbolic Music from Natural Language Prompts using an LLM-Enhanced Dataset

Weihan Xu, Julian McAuley, Taylor Berg-Kirkpatrick +2

cs.CL2020

Phonetic and Visual Priors for Decipherment of Informal Romanization

Maria Ryskina, Matthew R. Gormley, Taylor Berg-Kirkpatrick

cs.CL2017

SPINE: SParse Interpretable Neural Embeddings

Anant Subramanian, Danish Pruthi, Harsh Jhamtani +2

cs.CL2024

Smaller Language Models are Better Black-box Machine-Generated Text Detectors

Niloofar Mireshghallah, Justus Mattern, Sicun Gao +2

cs.SD2024

DITTO: Diffusion Inference-Time T-Optimization for Music Generation

Zachary Novack, Julian McAuley, Taylor Berg-Kirkpatrick +1

cs.CL2021

Masked Measurement Prediction: Learning to Jointly Predict Quantities and Units from Textual Context

Daniel Spokoyny, Ivan Lee, Zhao Jin +1

cs.CL2021

Improving Automated Evaluation of Open Domain Dialog via Diverse Reference Augmentation

Varun Gangal, Harsh Jhamtani, Eduard Hovy +1

cs.CL2020

Like hiking? You probably enjoy nature: Persona-grounded Dialog with Commonsense Expansions

Bodhisattwa Prasad Majumder, Harsh Jhamtani, Taylor Berg-Kirkpatrick +1

cs.CL2019

Beyond BLEU: Training Neural Machine Translation with Semantic Similarity

John Wieting, Taylor Berg-Kirkpatrick, Kevin Gimpel +1

cs.CR2024

Imprompter: Tricking LLM Agents into Improper Tool Use

Xiaohan Fu, Shuheng Li, Zihan Wang +4

cs.CL2020

Where New Words Are Born: Distributional Semantic Analysis of Neologisms and Their Semantic Neighborhoods

Maria Ryskina, Ella Rabinovich, Taylor Berg-Kirkpatrick +2

cs.CL2024

MORL-Prompt: An Empirical Analysis of Multi-Objective Reinforcement Learning for Discrete Prompt Optimization

Yasaman Jafari, Dheeraj Mekala, Rose Yu +1

cs.SD2023

CLIPSep: Learning Text-queried Sound Separation with Noisy Unlabeled Videos

Hao-Wen Dong, Naoya Takahashi, Yuki Mitsufuji +2

cs.PL2024

HYSYNTH: Context-Free LLM Approximation for Guiding Program Synthesis

Shraddha Barke, Emmanuel Anaya Gonzalez, Saketh Ram Kasibatla +2

cs.CV2026

Optical Context Compression Is Just (Bad) Autoencoding

Ivan Yee Lee, Cheng Yang, Taylor Berg-Kirkpatrick

cs.CL2026

Studying the Soupability of Documents in State Space Models

Yasaman Jafari, Zixian Wang, Leon Bergen +1

cs.CL2022

An Unsupervised Masking Objective for Abstractive Multi-Document News Summarization

Nikolai Vogler, Songlin Li, Yujie Xu +2

cs.LG2019

An Empirical Investigation of Global and Local Normalization for Recurrent Neural Sequence Models Using a Continuous Relaxation to Beam Search

Kartik Goyal, Chris Dyer, Taylor Berg-Kirkpatrick

cs.LG2026

Parcae: Scaling Laws For Stable Looped Language Models

Hayden Prairie, Zachary Novack, Taylor Berg-Kirkpatrick +1

cs.LG2024

Is attention required for ICL? Exploring the Relationship Between Model Architecture and In-Context Learning Ability

Ivan Lee, Nan Jiang, Taylor Berg-Kirkpatrick

cs.CL2023

URL-BERT: Training Webpage Representations via Social Media Engagements

Ayesha Qamar, Chetan Verma, Ahmed El-Kishky +3

cs.CL2021

Unsupervised Enrichment of Persona-grounded Dialog with Background Stories

Bodhisattwa Prasad Majumder, Taylor Berg-Kirkpatrick, Julian McAuley +1

cs.LG2022

Checklist Models for Improved Output Fluency in Piano Fingering Prediction

Nikita Srivatsan, Taylor Berg-Kirkpatrick

cs.SD2025

PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing

Phillip Long, Zachary Novack, Taylor Berg-Kirkpatrick +1

cs.CL2026

From Reasoning to Pixels: Benchmarking the Alignment Gap in Unified Multimodal Models

Cheng Yang, Chufan Shi, Bo Shui +7

cs.CL2023

A Block Metropolis-Hastings Sampler for Controllable Energy-based Text Generation

Jarad Forristal, Niloofar Mireshghallah, Greg Durrett +1

cs.CL2021

Cross-Lingual Syntactic Transfer through Unsupervised Adaptation of Invertible Projections

Junxian He, Zhisong Zhang, Taylor Berg-Kirkpatrick +1

cs.LG2021

Style Pooling: Automatic Text Style Obfuscation for Improved Classification Fairness

Fatemehsadat Mireshghallah, Taylor Berg-Kirkpatrick

cs.SD2025

WildFX: A DAW-Powered Pipeline for In-the-Wild Audio FX Graph Modeling

Qihui Yang, Taylor Berg-Kirkpatrick, Julian McAuley +1

cs.CL2018

Unsupervised Learning of Syntactic Structure with Invertible Neural Projections

Junxian He, Graham Neubig, Taylor Berg-Kirkpatrick

cs.CL2023

Towards Answering Climate Questionnaires from Unstructured Climate Reports

Daniel Spokoyny, Tanmay Laud, Tom Corringham +1

cs.SD2026

Low-Resource Guidance for Controllable Latent Audio Diffusion

Zachary Novack, Zack Zukowski, CJ Carr +6