Showing cs.LGShow all
2 papers · 1 filter
cs.LG2025
DuPO: Enabling Reliable LLM Self-Verification via Dual Preference Optimization
Shuaijie She, Yu Bao, Yu Lu +7
We present DuPO, a dual learning-based preference optimization framework that generates annotation-free feedback via a generalized duality. DuPO addresses two key limitations: Rein…
cs.LG2024
A Comprehensive Solution to Connect Speech Encoder and Large Language Model for ASR
Van Tung Pham, Yist Lin, Tao Han +4
Recent works have shown promising results in connecting speech encoders to large language models (LLMs) for speech recognition. However, several limitations persist, including limi…