2 papers
cs.CL2025
Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
Yue Xu, Chengyan Fu, Li Xiong +2
Pre-training large language models (LLMs) on vast text corpora enhances natural language processing capabilities but risks encoding social biases, particularly gender bias. While p…
cs.CR2024
: A Comprehensive Study on Jailbreak Attacks and Defenses for Multimodal Large Language Models
Fenghua Weng, Yue Xu, Chengyan Fu +1
As deep learning advances, Large Language Models (LLMs) and their multimodal counterparts, Multimodal Large Language Models (MLLMs), have shown exceptional performance in many real…