papers

Publications (69)

cs.CV2024

DINOv2: Learning Robust Visual Features without Supervision

Maxime Oquab, Timothée Darcet, Théo Moutakanni +23

cs.HC2023

Alexa Arena: A User-Centric Interactive Platform for Embodied AI

Qiaozi Gao, Govind Thattai, Suhaila Shakiah +24

cs.AI2025

YINYANG-ALIGN: Benchmarking Contradictory Objectives and Proposing Multi-Objective Optimization based DPO for Text-to-Image Alignment

Amitava Das, Yaswanth Narsupalli, Gurpreet Singh +5

cs.CV2023

MAViL: Masked Audio-Video Learners

Po-Yao Huang, Vasu Sharma, Hu Xu +7

cs.AI2026

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi +3

cs.LG2023

Scaling Autoregressive Multi-Modal Models: Pretraining and Instruction Tuning

Lili Yu, Bowen Shi, Ramakanth Pasunuru +24

cs.CL2026

Findings of the Counter Turing Test: AI-Generated Text Detection

Rajarshi Roy, Gurpreet Singh, Ashhar Aziz +16

cs.CR2025

SALT: Steering Activations towards Leakage-free Thinking in Chain of Thought

Shourya Batra, Pierce Tillman, Samarth Gaggar +6

cs.SD2023

FLAP: Fast Language-Audio Pre-training

Ching-Feng Yeh, Po-Yao Huang, Vasu Sharma +2

cs.CL2026

From Personas to Plot: Character-Grounded Multi-Agent Story Generation for Long-Form Narratives

Aayush Aluru, Chloe Ho, Muhammad Hammouri +5

cs.CV2025

Distill CLIP (DCLIP): Enhancing Image-Text Retrieval via Cross-Modal Transformer Distillation

Daniel Csizmadia, Andrei Codreanu, Victor Sim +5

cs.CL2026

NarrativeWorldBench: A Frontier-Saturated Benchmark and a Latent World Model for Long-Horizon Co-Creative Audio Drama

Logan Mann, Abdur Rahman, Mohammad Saifullah +2

cs.CL2026

A Comprehensive Dataset for Human vs. AI Generated Text Detection

Rajarshi Roy, Gurpreet Singh, Ashhar Aziz +17

cs.CL2025

Pruning for Performance: Efficient Idiom and Metaphor Classification in Low-Resource Konkani Using mBERT

Timothy Do, Pranav Saran, Harshita Poojary +4

cs.CV2024

The Brittleness of AI-Generated Image Watermarking Techniques: Examining Their Robustness Against Visual Paraphrasing Attacks

Niyar R Barman, Krish Sharma, Ashhar Aziz +7

cs.CV2025

COREVQA: A Crowd Observation and Reasoning Entailment Visual Question Answering Benchmark

Ishant Chintapatla, Kazuma Choji, Naaisha Agarwal +6

cs.AI2025

FRIT: Using Causal Importance to Improve Chain-of-Thought Faithfulness

Anand Swaroop, Akshat Nallani, Saksham Uboweja +7

cs.CL2025

Advancing Uto-Aztecan Language Technologies: A Case Study on the Endangered Comanche Language

Jesus Alvarez C, Daua D. Karajeanes, Ashley Celeste Prado +5

cs.CL2025

TRUTH DECAY: Quantifying Multi-Turn Sycophancy in Language Models

Joshua Liu, Aarav Jain, Soham Takuri +5

cs.CL2026

Sarc7: Evaluating Sarcasm Detection and Generation with Seven Types and Emotion-Informed Techniques

Raina Gao, Alyssa Jeong, Lang Xiong +4

cs.CL2025

Pause-Tuning for Long-Context Comprehension: A Lightweight Approach to LLM Attention Recalibration

James Begin, Namit Agrawal, Eshan Singh +4

cs.CL2025

Adaptive Originality Filtering: Rejection Based Prompting and RiddleScore for Culturally Grounded Multilingual Riddle Generation

Duy Le, Kent Ziti, Evan Girard-Sun +4

cs.LG2026

Mechanistic origins of catastrophic forgetting: why RL preserves circuits better than SFT?

Jeanmely Rojas Nunez, Viraj Sawant, Nathan Allen +4

cs.AI2026

Playing Devil's Advocate: Off-the-Shelf Persona Vectors Rival Targeted Steering for Sycophancy

Ishaan Kelkar, Nebras Alam, Vikram Kakaria +3

cs.CV2026

Findings of the Counter Turing Test: AI-Generated Image Detection

Rajarshi Roy, Nasrin Imanpour, Ashhar Aziz +16

cs.LG2025

Universal Neurons in GPT-2: Emergence, Persistence, and Functional Impact

Advey Nandan, Cheng-Ting Chou, Amrit Kurakula +4

cs.CL2025

AdversariaL attacK sAfety aLIgnment(ALKALI): Safeguarding LLMs through GRACE: Geometric Representation-Aware Contrastive Enhancement- Introducing Adversarial Vulnerability Quality Index (AVQI)

Danush Khanna, Gurucharan Marthi Krishna Kumar, Basab Ghosh +5

cs.CL2025

Rewrite-to-Rank: Optimizing Ad Visibility via Retrieval-Aware Text Rewriting

Chloe Ho, Ishneet Sukhvinder Singh, Diya Sharma +4

eess.SY2025

Safe Reinforcement Learning-based Control for Hydrogen Diesel Dual-Fuel Engines

Vasu Sharma, Alexander Winkler, Armin Norouzi +3

cs.LG2025

DPO Kernels: A Semantically-Aware, Kernel-Enhanced, and Divergence-Rich Paradigm for Direct Preference Optimization

Amitava Das, Suranjana Trivedy, Danush Khanna +8

cs.CL2025

Interpreting the Latent Structure of Operator Precedence in Language Models

Dharunish Yugeswardeenoo, Harshil Nukala, Ved Shah +4

cs.LG2024

An Introduction to Vision-Language Modeling

Florian Bordes, Richard Yuanzhe Pang, Anurag Ajay +38

cs.CV2026

A Comprehensive Dataset for Human vs. AI Generated Image Detection

Rajarshi Roy, Ashhar Aziz, Shashwat Bajpai +17

cs.LG2025

From Directions to Cones: Exploring Multidimensional Representations of Propositional Facts in LLMs

Stanley Yu, Vaidehi Bulusu, Oscar Yasunaga +5

cs.AI2026

FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds

Kapil Wanaskar, Gaytri Jena, Aman Chadha +3

cs.AI2026

Asymmetric Collapse in Model Merging: When Refusal Over- writes Recognition

Aarnav Choudhary, Matheus Fonseca Rocha, Jiwon Seo +2

cs.AI2025

Reasoning Relay: Evaluating Stability and Interchangeability of Large Language Models in Mathematical Reasoning

Leo Lu, Jonathan Zhang, Sean Chua +4

cs.CV2025

Peccavi: Visual Paraphrase Attack Safe and Distortion Free Image Watermarking Technique for AI-Generated Images

Shreyas Dixit, Ashhar Aziz, Shashwat Bajpai +4

cs.AI2025

SMAGDi: Socratic Multi Agent Interaction Graph Distillation for Efficient High Accuracy Reasoning

Aayush Aluru, Myra Malik, Samarth Patankar +4

cs.CL2025

Causal Language Control in Multilingual Transformers via Sparse Feature Steering

Cheng-Ting Chou, George Liu, Jessica Sun +4

cs.CL2025

NovelHopQA: Diagnosing Multi-Hop Reasoning Failures in Long Narrative Contexts

Abhay Gupta, Michael Lu, Kevin Zhu +2

cs.AI2025

AgentChangeBench: A Multi-Dimensional Evaluation Framework for Goal-Shift Robustness in Conversational AI

Manik Rana, Calissa Man, Anotida Expected Msiiwa +5

cs.CV2018

Community Regularization of Visually-Grounded Dialog

Akshat Agarwal, Swaminathan Gurumurthy, Vasu Sharma +2

cs.MA2025

WOLF: Werewolf-based Observations for LLM Deception and Falsehoods

Mrinal Agarwal, Saad Rana, Theo Sundoro +5

cs.AI2026

ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs

Rohan Subramanian Thomas, Shikhar Shiromani, Abdullah Chaudhry +4

cs.CE2026

Preference Optimization Drives Monoculture in LLM Prediction Markets

James Begin, Brendan Gho, Suman Muppavarapu +6

cs.CL2024

Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM

Sainbayar Sukhbaatar, Olga Golovneva, Vasu Sharma +8

cs.CV2025

Seamless Interaction: Dyadic Audiovisual Motion Modeling and Large-Scale Dataset

Vasu Agrawal, Akinniyi Akinyemi, Kathryn Alvero +81

cs.CL2025

Alignment Quality Index (AQI) : Beyond Refusals: AQI as an Intrinsic Alignment Diagnostic via Latent Geometry, Cluster Divergence, and Layer wise Pooled Representations

Abhilekh Borah, Chhavi Sharma, Danush Khanna +12

cs.CV2023

E-ViLM: Efficient Video-Language Model via Masked Video Modeling with Semantic Vector-Quantized Tokenizer

Jacob Zhiyuan Fang, Skyler Zheng, Vasu Sharma +1

cs.CV2024

A Picture is Worth More Than 77 Text Tokens: Evaluating CLIP-Style Models on Dense Captions

Jack Urbanek, Florian Bordes, Pietro Astolfi +3

cs.AI2022

CH-MARL: A Multimodal Benchmark for Cooperative, Heterogeneous Multi-Agent Reinforcement Learning

Vasu Sharma, Prasoon Goyal, Kaixiang Lin +3

cs.CL2025

Probe-Rewrite-Evaluate: A Workflow for Reliable Benchmarks and Quantifying Evaluation Awareness

Lang Xiong, Nishant Bhargava, Jianhang Hong +4

cs.CL2024

Text Quality-Based Pruning for Efficient Training of Language Models

Vasu Sharma, Karthik Padthe, Newsha Ardalani +8

cs.AI2025

Evaluation Awareness Scales Predictably in Open-Weights Large Language Models

Maheep Chaudhary, Ian Su, Nikhil Hooda +6

cs.RO2026

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills

Gaytri Jena, Kapil Wanaskar, Vinija Jain +3

cs.AI2025

The Geometry of Harmfulness in LLMs through Subconcept Probing

McNair Shah, Saleena Angeline, Adhitya Rajendra Kumar +5

cs.CV2026

MiSCHiEF: A Benchmark in Minimal-Pairs of Safety and Culture for Holistic Evaluation of Fine-Grained Image-Caption Alignment

Sagarika Banerjee, Tangatar Madi, Advait Swaminathan +4

cs.MA2026

From Competition to Coordination: Market Making as a Scalable Framework for Safe and Aligned Multi-Agent LLM Systems

Brendan Gho, Suman Muppavarapu, Afnan Shaik +6

cs.LG2025

Peek-a-Boo Reasoning: Contrastive Region Masking in MLLMs

Isha Chaturvedi, Anjana Nair, Yushen Li +5

cs.CV2025

Understanding Trade offs When Conditioning Synthetic Data

Brandon Trabucco, Qasim Wani, Benjamin Pikus +1

cs.SI2026

@GrokSet: multi-party Human-LLM Interactions in Social Media

Matteo Migliarini, Berat Ercevik, Oluwagbemike Olowe +5

cs.CV2025

Demystifying CLIP Data

Hu Xu, Saining Xie, Xiaoqing Ellen Tan +7

cs.CL2025

ERGO: Entropy-guided Resetting for Generation Optimization in Multi-turn Language Models

Haziq Mohammad Khalid, Athikash Jeyaganthan, Timothy Do +4

cs.HC2023

Alexa, play with robot: Introducing the First Alexa Prize SimBot Challenge on Embodied AI

Hangjie Shi, Leslie Ball, Govind Thattai +39

eess.SY2025

Incorporating a Deep Neural Network into Moving Horizon Estimation for Embedded Thermal Torque Derating of an Electric Machine

Alexander Winkler, Pranav Shah, Katrin Baumgärtner +3

cs.CV2025

Deconstructing Bias: A Multifaceted Framework for Diagnosing Cultural and Compositional Inequities in Text-to-Image Generative Models

Muna Numan Said, Aarib Zaidi, Rabia Usman +5

cs.CL2025

Rosetta-PL: Propositional Logic as a Benchmark for Large Language Model Reasoning

Shaun Baek, Shaun Esua-Mensah, Cyrus Tsui +6

cs.CL2025

DuoLens: A Framework for Robust Detection of Machine-Generated Multilingual Text and Code

Shriyansh Agrawal, Aidan Lau, Sanyam Shah +4