activity
20242026
collaborators

6 papers

cs.CL2026

Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning

Miao Li, Irina Saparina, Alexander Gurung +1

Recent large language models support inputs of up to 10 million tokens, yet they perform poorly on long-context tasks that require complex reasoning. Such tasks can be solved using…

cs.CL2026

Reasoning about Intent for Ambiguous Requests

Irina Saparina, Mirella Lapata

Large language models often respond to ambiguous requests by implicitly committing to one interpretation, frustrating users and creating safety risks when that interpretation is wr…

cs.AI2026

SciTrek: Evaluating and Improving Long-Context Numerical Reasoning over Scientific Articles

Miao Li, Alexander Gurung, Irina Saparina +1

We introduce SciTrek, a synthetic question-answering dataset for assessing and improving long-context numerical reasoning in large language models (LLMs). Existing long-context dat…

cs.CL2025

Asking a Language Model for Diverse Responses

Sergey Troshin, Irina Saparina, Antske Fokkens +1

Large language models increasingly rely on explicit reasoning chains and can produce multiple plausible responses for a given context. We study the candidate sampler that produces…

cs.CL2025

Disambiguate First, Parse Later: Generating Interpretations for Ambiguity Resolution in Semantic Parsing

Irina Saparina, Mirella Lapata

Handling ambiguity and underspecification is an important challenge in natural language interfaces, particularly for tasks like text-to-SQL semantic parsing. We propose a modular a…

cs.CL2024

AMBROSIA: A Benchmark for Parsing Ambiguous Questions into Database Queries

Irina Saparina, Mirella Lapata

Practical semantic parsers are expected to understand user utterances and map them to executable programs, even when these are ambiguous. We introduce a new benchmark, AMBROSIA, wh…