collaborators

6 papers

cs.LG2026

LEMUR: Latent Entropy-aware Multimodal Unlearning via Visual-anchored Reasoning Redirection

Xinhao Zhong, Yuxia Qiao, Junhao Li +3

Reinforcement-learning (RL) post-training equips multimodal large reasoning models (MLRMs) with exploratory chains of thought (CoT), substantially improving visual reasoning. Howev…

cs.CV2026

FlowErase-OPD: Multi-Concept Erasure via Anchored On-Policy Distillation in Flow Matching Models

Yi Sun, Yimin Zhou, Xinhao Zhong +3

Recent advances in flow matching models have substantially improved the quality of text-to-image generation, but have also raised increasing safety concerns due to their potential…

cs.RO2026

Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation

Yicheng Jiang, Jiaxu Wang, Junhao He +8

Current 3D-aware pretraining methods for embodied perception and manipulation are largely built on differentiable rendering frameworks, producing either fully implicit neural field…

cs.CV2026

CPC-VAR:Continual Personalized and Compositional Generation in Visual Autoregressive Models

Junhao Li, Xinhao Zhong, Yi sun +4

Visual autoregressive (VAR) models have recently emerged as an efficient paradigm for text-to-image generation. Despite their strong generative capability, existing VAR-based perso…

cs.CV2026

ActErase: A Training-Free Paradigm for Precise Concept Erasure via Activation Redirection

Yi Sun, Xinhao Zhong, Hongyan Li +4

Recent advances in text-to-image diffusion models have demonstrated remarkable generation capabilities, yet they raise significant concerns regarding safety, copyright, and ethical…

cs.CV2026

Closing the Safety Gap: Surgical Concept Erasure in Visual Autoregressive Models

Xinhao Zhong, Yimin Zhou, Zhiqi Zhang +6

The rapid progress of visual autoregressive (VAR) models has brought new opportunities for text-to-image generation, but also heightened safety concerns. Existing concept erasure t…