activity
20242026
collaborators

11 papers

cs.CL2026

PolyAlign: Conditional Human-Distribution Alignment

L. D. M. S. Sai Teja, Ufaq Khan, Sathira Silva +2

Post-training methods such as supervised fine-tuning (SFT) and preference optimization typically align language models toward a single global assistant behavior. While effective fo…

cs.CV2025

GRAID: Enhancing Spatial Reasoning of VLMs Through High-Fidelity Data Generation

Karim Elmaaroufi, Liheng Lai, Justin Svegliato +3

Vision Language Models (VLMs) achieve strong performance on many vision-language tasks but often struggle with spatial reasoning$\unicode{x2014}$a prerequisite for many application…

cs.IR2025

WARP: An Efficient Engine for Multi-Vector Retrieval

Jan Luca Scheerer, Matei Zaharia, Christopher Potts +2

Multi-vector retrieval methods such as ColBERT and its recent variant, the ConteXtualized Token Retriever (XTR), offer high accuracy but face efficiency challenges at scale. To add…

cs.LG2025

: Learning Automata from Examples using Natural Language Oracles

Marcell Vazquez-Chanlatte, Karim Elmaaroufi, Stefan J. Witwicki +2

Expert demonstrations have proven an easy way to indirectly specify complex tasks. Recent algorithms even support extracting unambiguous formal specifications, e.g. deterministic f…

cs.AI2025

EXP-Bench: Can AI Conduct AI Research Experiments?

Patrick Tser Jern Kon, Jiachen Liu, Xinyi Zhu +10

Automating AI research holds immense potential for accelerating scientific progress, yet current AI agents struggle with the complexities of rigorous, end-to-end experimentation. W…

cs.IR2025

ColBERT-serve: Efficient Multi-Stage Memory-Mapped Scoring

Kaili Huang, Thejas Venkatesh, Uma Dingankar +9

We study serving retrieval models, specifically late interaction models like ColBERT, to many concurrent users at once and under a small budget, in which the index may not fit in m…