3 papers
cs.IR2026
RecGPT-Mobile-V2 Technical Report
Lingqing Zhang, Bin Zhang, Weipeng Huang +25
Personalized Query prediction maps implicit behavioral signals---clicks, favorites, purchases, and post-purchase exploration---to explicit retrieval intent. On-device deployment ma…
cs.CV2026
Can We Perform Online RL for Image Editing without Editing Rewards?
Qichao Ma, Jikang Cheng, Ling Liang +3
Reinforcement learning (RL) enables direct preference optimization for image editing through editing-specific rewards, which remain less developed due to costly triplet supervision…
cs.CL2024
Inner-Probe: Discovering Copyright-related Data Generation in LLM Architecture
Qichao Ma, Rui-Jie Zhu, Peiye Liu +8
Large Language Models (LLMs) utilize extensive knowledge databases and show powerful text generation ability. However, their reliance on high-quality copyrighted datasets raises co…