3 papers
cs.CR2025
PerProb: Indirectly Evaluating Memorization in Large Language Models
Yihan Liao, Jacky Keung, Xiaoxue Ma +2
The rapid advancement of Large Language Models (LLMs) has been driven by extensive datasets that may contain sensitive information, raising serious privacy concerns. One notable th…
cs.CR2025
Exposing and Defending Membership Leakage in Vulnerability Prediction Models
Yihan Liao, Jacky Keung, Xiaoxue Ma +2
Neural models for vulnerability prediction (VP) have achieved impressive performance by learning from large-scale code repositories. However, their susceptibility to Membership Inf…
cs.SE2025
Chart2Code-MoLA: Efficient Multi-Modal Code Generation via Adaptive Expert Routing
Yifei Wang, Jacky Keung, Zhenyu Mao +2
Chart-to-code generation is a critical task in automated data visualization, translating complex chart structures into executable programs. While recent Multi-modal Large Language…