4 papers
SKILL.state: Scalable Long-Horizon Agent Skills
Sanket Badhe, Priyanka Tiwari, Jonghyun Chung
Large Language Models (LLMs) increasingly act as autonomous agents executing complex, long-running procedural skills. Existing agent runtimes maintain execution by continually appe…
Towards a Systems Foundation for Agentic Skills: Architecture, Lifecycle, and Security
Sanket Badhe, Deep Shah, Priyanka Tiwari +1
Autonomous large language model (LLM) agents increasingly face reliability, context consumption, and execution stability bottlenecks when deployed on complex, long-horizon tasks. W…
Agent Skill Security: Threat Models, Attacks, Defenses, and Evaluation
Sanket Badhe, Priyanka Tiwari
Reusable skills are becoming a fundamental building block of Large Language Model (LLM) agents, enabling capabilities to be packaged, shared, and reused across diverse applications…
CROP: Token-Efficient Reasoning in Large Language Models via Regularized Prompt Optimization
Deep Shah, Sanket Badhe, Nehal Kathrotia +1
Large Language Models utilizing reasoning techniques improve task performance but incur significant latency and token costs due to verbose generation. Existing automatic prompt opt…