3 papers
cs.SE2026
Tangent: An Empirical Study of Testing Practices for LLM-Based Agent Applications
Rangeet Pan, Tyler Stennett, Divya Sankar +5
Agents built on large language models (LLMs) are increasingly used to build applications that perform complex, multi-step tasks involving reasoning, tool use, and interaction with…
cs.SE2026
Sakura: An Approach for Generating Complex Tests from Natural Language Test Descriptions
Tyler Stennett, Rangeet Pan, Bridget McGinn +2
Research on automating software testing has spanned several decades. Most existing approaches generate unit tests for individual methods, validate isolated API endpoints, or target…
cs.SE2026
ScarfBench: A Benchmark for Cross-Framework Application Migration in Enterprise Java
Advait Pavuluri, Bridget McGinn, Ashita Saxena +6
Java remains central to enterprise software, and many applications outlive their original architecture. Migrating them across frameworks is a behavior-preserving refactoring spanni…