1 citations · 1 across the 3 of their papers we have counts for
3 papers
cs.CL2025
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
Zhiling Ye, Yun Yue, Haowen Wang +11
Open-ended evaluation is essential for deploying large language models in real-world settings. In studying HealthBench, we observe that using the model itself as a grader and gener…
cs.LG2025
Learning to Align, Aligning to Learn: A Unified Approach for Self-Optimized Alignment
Haowen Wang, Yun Yue, Zhiling Ye +12
Alignment methodologies have emerged as a critical pathway for enhancing language model alignment capabilities. While SFT (supervised fine-tuning) accelerates convergence through d…
cs.DC2024★ 1 cited
EDiT: A Local-SGD-Based Efficient Distributed Training Method for Large Language Models
Jialiang Cheng, Ning Gao, Yun Yue +3
Distributed training methods are crucial for large language models (LLMs). However, existing distributed training methods often suffer from communication bottlenecks, stragglers, a…