Showing cs.LGShow all
3 papers · 1 filter
cs.LG2026
Failing to Explore: Language Models on Interactive Tasks
Mahdi JafariRaviz, Keivan Rezaei, Arshia Soltani Moakhar +3
We evaluate language models on their ability to explore interactive environments under a limited interaction budget. We introduce three parametric tasks with controllable explorati…
cs.LG2025
RePanda: Pandas-powered Tabular Verification and Reasoning
Atoosa Malemir Chegini, Keivan Rezaei, Hamid Eghbalzadeh +1
Fact-checking tabular data is essential for ensuring the accuracy of structured information. However, existing methods often rely on black-box models with opaque reasoning. We intr…
cs.LG2025
A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models
Zihao Lin, Samyadeep Basu, Mohammad Beigi +18
The rise of foundation models has transformed machine learning research, prompting efforts to uncover their inner workings and develop more efficient and reliable applications for…