2 papers
cs.CL2026
BARRED: Synthetic Training of Custom Policy Guardrails via Asymmetric Debate
Arnon Mazza, Elad Levi
Deploying guardrails for custom policies remains challenging, as generic safety models fail to capture task-specific requirements, while prompting LLMs suffers from inconsistent bo…
cs.CL2025
IntellAgent: A Multi-Agent Framework for Evaluating Conversational AI Systems
Elad Levi, Ilan Kadar
Large Language Models (LLMs) are transforming artificial intelligence, evolving into task-oriented systems capable of autonomous planning and execution. One of the primary applicat…