3 papers
cs.HC2026
PrivacyAkinator: Articulating Key Privacy Design Decisions by Answering LLM-Generated Multiple-choice Questions
Qiyu Li, Yuen Sum Wong, Yuen Kei Wong +2
NIST's Privacy Risk Assessment Methodology (PRAM) provides a structured framework for privacy experts to assess privacy risks. However, its complexity and reliance on expert knowle…
cs.AI2025
GameArena: Evaluating LLM Reasoning through Live Computer Games
Lanxiang Hu, Qiyu Li, Anze Xie +4
Evaluating the reasoning abilities of large language models (LLMs) is challenging. Existing benchmarks often depend on static datasets, which are vulnerable to data contamination a…
cs.CR2024
Moderator: Moderating Text-to-Image Diffusion Models through Fine-grained Context-based Policies
Peiran Wang, Qiyu Li, Longxuan Yu +3
We present Moderator, a policy-based model management system that allows administrators to specify fine-grained content moderation policies and modify the weights of a text-to-imag…