2 papers
cs.AI2026
ScholarStack: Layered Research Asset Orchestration and Cross-Task Reuse for Scientific Agents
ScholarSeed AI Team, Caoqinwei Gong, Xue Jiang +17
Scientific agents support a range of literature-based research tasks, such as retrieval, question answering, evidence-grounded generation, and claim assessment. Most existing syste…
cs.CL2026
An Analysis of Training-Free Self-Reported Confidence in Language Models
Lukas Meyer, Sofia Rossi, Wei Chen +2
Large language models can report a numerical confidence together with generated content, but it is unclear whether this report is more than calibrated rhetoric. We analyze three tr…