2 papers
cs.CL2026
Measuring LLM Sycophancy under Sustained Multi-Turn Pressure
Leyuan Tang, Kangda Wei, Tianyu Jiang +1
Large language models (LLMs) may abandon correct positions when users push back, exhibiting a failure mode known as sycophancy. Existing evaluations typically use short, pre-specif…
cs.CR2026
Privacy-Preserving Heterogeneous Multi-LLM Federated Inference for Cognitive Diagnosis
Yagna Manasa Boyapati, Chong Yu, Tianyu Jiang +1
Significant challenges remain in AI-driven educational systems in balancing privacy preservation with accurate cognitive diagnosis. To overcome this, we propose a federated inferen…