2 papers
cs.CL2026
Enhancing reasoning accuracy in large language models during inference time
Vinay Sharma, Manish Jain
Large Language Models (LLMs) often exhibit strong linguistic abilities while remaining unreliable on multi-step reasoning tasks, particularly when deployed without additional train…
cs.AI2026
Real-Time Trust Verification for Safe Agentic Actions using TrustBench
Tavishi Sharma, Vinayak Sharma, Pragya Sharma
As large language models evolve from conversational assistants to autonomous agents, ensuring trustworthiness requires a fundamental shift from post-hoc evaluation to real-time act…