2 citations · 2 across the 2 of their papers we have counts for
2 papers
cs.LG2026
-DPO: Direct Preference Optimization via Ratio Reward Margin
Zhengyuan Fan, Zhonghua Wu, Yuxuan Du +1
Reference-free preference optimization has emerged as an efficient alternative to reinforcement learning from human feedback, with Simple Preference Optimization(SimPO) demonstrati…
physics.flu-dyn2024★ 2 cited
Efficient aerodynamic coefficients prediction with a long sequence neural network
Zemin Cai, Zhengyuan Fan, Tianshu Liu
Traditionally, deriving aerodynamic parameters for an airfoil via Computational Fluid Dynamics requires significant time and effort. However, recent approaches employ neural networ…