2 papers
cs.CL2025
Ambiguity Awareness Optimization: Towards Semantic Disambiguation for Direct Preference Optimization
Jian Li, Shenglin Yin, Yujia Zhang +4
Direct Preference Optimization (DPO) is a widely used reinforcement learning from human feedback (RLHF) method across various domains. Recent research has increasingly focused on t…
cs.IR2024
: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
Fang Wang, Shenglin Yin, Xiaoying Bai +3
Multi-modal Entity Linking (MEL) is a fundamental component for various downstream tasks. However, existing MEL datasets suffer from small scale, scarcity of topic types and limite…