6 papers
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
Miao Li, Irina Saparina, Alexander Gurung +1
Recent large language models support inputs of up to 10 million tokens, yet they perform poorly on long-context tasks that require complex reasoning. Such tasks can be solved using…
Reasoning about Intent for Ambiguous Requests
Irina Saparina, Mirella Lapata
Large language models often respond to ambiguous requests by implicitly committing to one interpretation, frustrating users and creating safety risks when that interpretation is wr…
SciTrek: Evaluating and Improving Long-Context Numerical Reasoning over Scientific Articles
Miao Li, Alexander Gurung, Irina Saparina +1
We introduce SciTrek, a synthetic question-answering dataset for assessing and improving long-context numerical reasoning in large language models (LLMs). Existing long-context dat…
Asking a Language Model for Diverse Responses
Sergey Troshin, Irina Saparina, Antske Fokkens +1
Large language models increasingly rely on explicit reasoning chains and can produce multiple plausible responses for a given context. We study the candidate sampler that produces…
Disambiguate First, Parse Later: Generating Interpretations for Ambiguity Resolution in Semantic Parsing
Irina Saparina, Mirella Lapata
Handling ambiguity and underspecification is an important challenge in natural language interfaces, particularly for tasks like text-to-SQL semantic parsing. We propose a modular a…
AMBROSIA: A Benchmark for Parsing Ambiguous Questions into Database Queries
Irina Saparina, Mirella Lapata
Practical semantic parsers are expected to understand user utterances and map them to executable programs, even when these are ambiguous. We introduce a new benchmark, AMBROSIA, wh…