7 papers
Consilience: Conformally Calibrated Communication Control for Hidden-Profile Multi-Agent Reasoning
Abhijith Babu, Ramneet Kaur, Vishal Pramanik +7
Multi-agent LLM systems can improve reasoning by pooling diverse perspectives, but their effectiveness depends on coordinating communication, particularly in hidden-profile setting…
Discovering KV Cache Eviction Policies via LLM-Guided Program Evolution
Pratik Poudel, Yanzhao Wu, Sumit Jha +1
KV cache compression is critical for long-context inference, yet effective eviction policies remain difficult to design: existing prefill-stage methods often rely on hand-crafted s…
HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning
Runze Zhao, Dongruo Zhou, Sumit Kumar Jha +2
Cooperative multi-agent reinforcement learning (MARL) often relies on communication to mitigate partial observability, yet most existing protocols treat messages as flat dense vect…
ACE-RLHF: Automated Code Evaluation and Socratic Feedback Generation Tool using Large Language Models and Reinforcement Learning with Human Feedback
Tasnia Rahman, Sathish A. P. Kumar, Sumit Jha +1
Automated Program Repair tools are developed for generating feedback and suggesting a repair method for erroneous code. State of the art (SOTA) code repair methods rely on data-dri…
DML-RAM: Deep Multimodal Learning Framework for Robotic Arm Manipulation using Pre-trained Models
Sathish Kumar, Swaroop Damodaran, Naveen Kumar Kuruba +2
This paper presents a novel deep learning framework for robotic arm manipulation that integrates multimodal inputs using a late-fusion strategy. Unlike traditional end-to-end or re…
Enhanced Penalty-based Bidirectional Reinforcement Learning Algorithms
Sai Gana Sandeep Pula, Sathish A. P. Kumar, Sumit Jha +1
This research focuses on enhancing reinforcement learning (RL) algorithms by integrating penalty functions to guide agents in avoiding unwanted actions while optimizing rewards. Th…