3 papers
cs.AI2026
Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework
Ali Åenol, Garima Agrawal, Huan Liu
Despite remarkable progress on reasoning benchmarks, current LLM evaluation practice remains anchored to final-answer correctness, providing limited insight into how models reason,…
cs.CL2025
Domain Knowledge-Enhanced LLMs for Fraud and Concept Drift Detection
Ali Åenol, Garima Agrawal, Huan Liu
Detecting deceptive conversations on dynamic platforms is increasingly difficult due to evolving language patterns and Concept Drift (CD)-i.e., semantic or topical shifts that alte…
cs.CL2025
Joint Detection of Fraud and Concept Drift inOnline Conversations with LLM-Assisted Judgment
Ali Senol, Garima Agrawal, Huan Liu
Detecting fake interactions in digital communication platforms remains a challenging and insufficiently addressed problem. These interactions may appear as harmless spam or escalat…