2 papers
cs.AI2026
Efficient Post-training of LLMs for Code Generation With Offline Reinforcement Learning
Mingze Wu, Abhinav Anand, Shweta Verma +1
Post-training using online reinforcement learning (RL) is an important training step for LLMs, including code-generating models. However, online RL for code generation involves LLM…
cs.SE2025
CodeSSM: Towards State Space Models for Code Understanding
Shweta Verma, Abhinav Anand, Mira Mezini
Although transformers dominate many code-specific tasks, they have significant limitations. This paper explores State Space Models (SSMs) as a promising alternative for code unders…