35 citations · 251 across the 92 of their papers we have counts for
Showing 2025 · cs.AIShow all
3 papers · 2 filters
cs.AI2025
SciTrek: Evaluating and Improving Long-Context Numerical Reasoning over Scientific Articles
Miao Li, Alexander Gurung, Irina Saparina +1
We introduce SciTrek, a synthetic question-answering dataset for assessing and improving long-context numerical reasoning in large language models (LLMs). Existing long-context dat…
cs.AI2025
Meta-Adaptive Prompt Distillation for Few-Shot Visual Question Answering
Akash Gupta, Amos Storkey, Mirella Lapata
Large Multimodal Models (LMMs) often rely on in-context learning (ICL) to perform new visual question answering (VQA) tasks with minimal supervision. However, ICL performance, espe…
cs.AI2025
Debating for Better Reasoning: An Unsupervised Multimodal Approach
Ashutosh Adhikari, Mirella Lapata
As Large Language Models (LLMs) gain expertise across diverse domains and modalities, scalable oversight becomes increasingly challenging, particularly when their capabilities may…