2 papers
cs.AI2026
Taming the Implicit: Dual-Channel Risk-Aware Reinforcement Fine-Tuning for Continual Multimodal Post-Training
Yibei Liu, Jiajun Chen, Qianle Zhang +4
Reinforcement fine-tuning (RFT) is widely believed to inherently resist catastrophic forgetting in continual post-training of multimodal large language models. Under pronounced tas…
cs.LG2025
Lossless Privacy-Preserving Aggregation for Decentralized Federated Learning
Xiaoye Miao, Bin Li, Yanzhang +2
Privacy concerns arise as sensitive data proliferate. Despite decentralized federated learning (DFL) aggregating gradients from neighbors to avoid direct data transmission, it stil…