2 papers
cs.CL2025
Shallow Robustness, Deep Vulnerabilities: Multi-Turn Evaluation of Medical LLMs
Blazej Manczak, Eric Lin, Francisco Eiras +2
Large language models (LLMs) are rapidly transitioning into medical clinical use, yet their reliability under realistic, multi-turn interactions remains poorly understood. Existing…
cs.CL2025
Unified Multi-Task Learning & Model Fusion for Efficient Language Model Guardrailing
James O' Neill, Santhosh Subramanian, Eric Lin +1
The trend towards large language models (LLMs) for guardrailing against undesired behaviors is increasing and has shown promise for censoring user inputs. However, increased latenc…