collaborators

7 papers

cs.AI2026

Consilience: Conformally Calibrated Communication Control for Hidden-Profile Multi-Agent Reasoning

Abhijith Babu, Ramneet Kaur, Vishal Pramanik +7

Multi-agent LLM systems can improve reasoning by pooling diverse perspectives, but their effectiveness depends on coordinating communication, particularly in hidden-profile setting…

cs.DC2026

Discovering KV Cache Eviction Policies via LLM-Guided Program Evolution

Pratik Poudel, Yanzhao Wu, Sumit Jha +1

KV cache compression is critical for long-context inference, yet effective eviction policies remain difficult to design: existing prefill-stage methods often rely on hand-crafted s…

cs.AI2026

HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning

Runze Zhao, Dongruo Zhou, Sumit Kumar Jha +2

Cooperative multi-agent reinforcement learning (MARL) often relies on communication to mitigate partial observability, yet most existing protocols treat messages as flat dense vect…

cs.LG2025

ACE-RLHF: Automated Code Evaluation and Socratic Feedback Generation Tool using Large Language Models and Reinforcement Learning with Human Feedback

Tasnia Rahman, Sathish A. P. Kumar, Sumit Jha +1

Automated Program Repair tools are developed for generating feedback and suggesting a repair method for erroneous code. State of the art (SOTA) code repair methods rely on data-dri…

cs.LG2025

DML-RAM: Deep Multimodal Learning Framework for Robotic Arm Manipulation using Pre-trained Models

Sathish Kumar, Swaroop Damodaran, Naveen Kumar Kuruba +2

This paper presents a novel deep learning framework for robotic arm manipulation that integrates multimodal inputs using a late-fusion strategy. Unlike traditional end-to-end or re…

cs.LG2025

Enhanced Penalty-based Bidirectional Reinforcement Learning Algorithms

Sai Gana Sandeep Pula, Sathish A. P. Kumar, Sumit Jha +1

This research focuses on enhancing reinforcement learning (RL) algorithms by integrating penalty functions to guide agents in avoiding unwanted actions while optimizing rewards. Th…