activity
20242026
most citedProbing the Safety Response Boundary of Large Language Models via Unsafe Decoding Path Generation

1 citations · 1 across the 5 of their papers we have counts for

collaborators

7 papers

cs.CR2026

Co-Evolutionary Multi-Modal Alignment via Structured Adversarial Evolution

Guoxin Shi, Haoyu Wang, Zaihui Yang +2

Adversarial behavior plays a central role in aligning large language models with human values. However, existing alignment methods largely rely on static adversarial settings, whic…

cs.LG2026

UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning

Jiaxi Wu, Tiantian Zhang, Yuxing Wang +2

Robust adversarial reinforcement learning has emerged as an effective paradigm for training agents to handle uncertain disturbance in real environments, with critical applications…

cs.CV2025

Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation

Yifu Luo, Xinhao Hu, Keyu Fan +6

Reinforcement learning (RL) has garnered increasing attention in text-to-image (T2I) generation. However, most existing RL approaches are tailored to either diffusion models or aut…

cs.CL2025

Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models

Haoyuan Sun, Jiaqi Wu, Bo Xia +7

Standing in 2025, at a critical juncture in the pursuit of Artificial General Intelligence (AGI), reinforcement fine-tuning (RFT) has demonstrated significant potential in enhancin…

cs.RO2024

Morphology and Behavior Co-Optimization of Modular Satellites for Attitude Control

Yuxing Wang, Jie Li, Cong Yu +5

The emergence of modular satellites marks a significant transformation in spacecraft engineering, introducing a new paradigm of flexibility, resilience, and scalability in space ex…

cs.CV2024

Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through -divergence Minimization

Haoyuan Sun, Bo Xia, Yongzhe Chang +1

Direct Preference Optimization (DPO) has recently expanded its successful application from aligning large language models (LLMs) to aligning text-to-image models with human prefere…