1 citations · 2 across the 3 of their papers we have counts for
3 papers
cs.LG2025
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
Xue Zhou, Dapeng Man, Chen Xu +6
Offline reinforcement learning (RL) heavily relies on the coverage of pre-collected data over the target policy's distribution. Existing studies aim to improve data-policy coverage…
cs.AI2024★ 1 cited
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
Haolin Chen, Yihao Feng, Zuxin Liu +8
Large language models (LLMs) have shown impressive capabilities, but still struggle with complex reasoning tasks requiring multiple steps. While prompt-based methods like Chain-of-…
cs.IR2022★ 1 cited
Generating Negative Samples for Sequential Recommendation
Yongjun Chen, Jia Li, Zhiwei Liu +4
To make Sequential Recommendation (SR) successful, recent works focus on designing effective sequential encoders, fusing side information, and mining extra positive self-supervisio…