3 papers
cs.LG2025
Evaluating Parameter Efficient Methods for RLVR
Qingyu Yin, Yulun Wu, Zhennan Shen +6
We systematically evaluate Parameter-Efficient Fine-Tuning (PEFT) methods under the paradigm of Reinforcement Learning with Verifiable Rewards (RLVR). RLVR incentivizes language mo…
cs.AI2025
Refusal Falls off a Cliff: How Safety Alignment Fails in Reasoning?
Qingyu Yin, Chak Tou Leong, Linyi Yang +7
Large reasoning models (LRMs) with multi-step reasoning capabilities have shown remarkable problem-solving abilities, yet they exhibit concerning safety vulnerabilities that remain…
cs.CV2025
Position: Agentic Systems Constitute a Key Component of Next-Generation Intelligent Image Processing
Jinjin Gu
This position paper argues that the image processing community should broaden its focus from purely model-centric development to include agentic system design as an essential compl…