papers
Publications (12)
cs.LG2026
Understanding and Mitigating Spurious Signal Amplification in Test-Time Reinforcement Learning for Math Reasoning
Yongcan Yu, Lingxiao He, Jian Liang +5
cs.CR2026
Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning
Yanbo Wang, Minzheng Wang, Jian Liang +3
cs.CV2026
One Size, Many Fits: Aligning Diverse Group-Wise Click Preferences in Large-Scale Advertising Image Generation
Shuo Lu, Haohan Wang, Wei Feng +14
cs.CV2025
Cooperative Pseudo Labeling for Unsupervised Federated Classification
Kuangpu Guo, Lijun Sheng, Yongcan Yu +3
cs.CL2025
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
Yanbo Wang, Yongcan Yu, Jian Liang +1
cs.AI2026
WorldCoder-Bench: Benchmarking Physically Grounded 3D World Synthesis
Shuo Lu, Yinuo Xu, Kecheng Yu +8
cs.LG2025
Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning
Yongcan Yu, Lingxiao He, Shuo Lu +10
cs.LG2026
On the Vulnerability of Parameter-Level Defenses to Model Merging
Kuangpu Guo, Qingyan Zheng, Jian Liang +4
cs.CR2025
Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models
Yongcan Yu, Yanbo Wang, Ran He +1
cs.LG2023
Benchmarking Test-Time Adaptation against Distribution Shifts in Image Classification
Yongcan Yu, Lijun Sheng, Ran He +1
cs.LG2024
STAMP: Outlier-Aware Test-Time Adaptation with Stable Memory Replay
Yongcan Yu, Lijun Sheng, Ran He +1
cs.AI2026
Do MLLMs Really Understand Space? A Mathematical Reasoning Evaluation
Shuo Lu, Jianjie Cheng, Yinuo Xu +16