4 papers
Learning When to Stop: Prefix-Optimal Dynamic Diffusion Policies for Continuous Control
Rohit Kumar Salla, Manoj Saravanan, Simon Stepputtis
Diffusion policies are a powerful policy class for continuous control, but their iterative denoising process creates a substantial computational bottleneck. Reducing this cost requ…
CrossQ: Task-Aligned Cross-Token Conditional Quantization for Late Interaction Retrieval
Rohit Kumar Salla, Manoj Saravanan, Ramya Manasa Amancherla
Late-interaction retrievers like ColBERT achieve high quality but suffer from large multi-vector indices. Standard compression minimizes token reconstruction error, while ranking d…
Quantifying Cross-Query Contradictions in Multi-Query LLM Reasoning
Rohit Kumar Salla, Ramya Manasa Amancherla, Manoj Saravanan
Large language models frequently produce mutually inconsistent answers when reasoning over multiple related queries. We study case-file logical consistency: maintaining a globally…
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
Rohit Kumar Salla, Manoj Saravanan, Shrikar Reddy Kota
Large Language Models (LLMs) like LLaMA, Mistral, and Gemma are increasingly used in decision-critical domains such as healthcare, law, and finance, yet their reliability remains u…