Showing cs.SEShow all
2 papers · 1 filter
cs.SE2026
What Breaks When LLMs Code? Characterizing Operational Safety Failures of Agentic Code Assistants
Alif Al Hasan, Sumon Biswas
Autonomous coding agents built on large language models (LLMs) are rapidly being integrated into development workflows, yet their operational safety properties remain poorly unders…
cs.SE2025
Bias Testing and Mitigation in Black Box LLMs using Metamorphic Relations
Sina Salimian, Gias Uddin, Sumon Biswas +1
The widespread deployment of Large Language Models (LLMs) has intensified concerns about subtle social biases embedded in their outputs. Existing guardrails often fail when faced w…