collaborators

11 papers

cs.CL2026

CricBench: A Multilingual Benchmark for Evaluating LLMs in Cricket Analytics

Parth Agarwal, Navya Kommuri, Trizal Garg +7

Cricket is the second most popular sport worldwide, with billions of fans seeking advanced statistical insights unavailable through standard web searches. Although LLMs have advanc…

cs.LG2026

Generative Evolutionary Meta-Solver (GEMS): Scalable Surrogate-Free Multi-Agent Reinforcement Learning

Alakh Sharma, Gaurish Trivedi, Kartikey Singh Bhandari +4

Scalable multi-agent reinforcement learning (MARL) remains a central challenge for AI. Existing population-based methods, like Policy-Space Response Oracles, PSRO, require storing…

cs.LG2026

Trust Regions Sell, But Who's Buying? Overlap Geometry as an Alternative Trust Region for Policy Optimization

Gaurish Trivedi, Alakh Sharma, Kartikey Singh Bhandari +4

Standard trust-region methods constrain policy updates via Kullback-Leibler (KL) divergence. However, KL controls only an average divergence and does not directly prevent rare, lar…

cs.CL2026

SAC: A Framework for Measuring and Inducing Personality Traits in LLMs with Dynamic Intensity Control

Adithya Chittem, Aishna Shrivastava, Sai Tarun Pendela +2

Large language models (LLMs) have gained significant traction across a wide range of fields in recent years. There is also a growing expectation for them to display human-like pers…

cs.CR2025

Beyond Single Bugs: Benchmarking Large Language Models for Multi-Vulnerability Detection

Chinmay Pushkar, Sanchit Kabra, Dhruv Kumar +1

Large Language Models (LLMs) have demonstrated significant potential in automated software security, particularly in vulnerability detection. However, existing benchmarks primarily…

cs.CV2025

Exposing DeepFakes via Hyperspectral Domain Mapping

Aditya Mehta, Swarnim Chaudhary, Pratik Narang +1

Modern generative and diffusion models produce highly realistic images that can mislead human perception and even sophisticated automated detection systems. Most detection methods…