1 paper
Qihang Yan, Xinyu Zhang, Luming Guo +2
Large Language Models (LLMs) struggle with accuracy, domain-specific reasoning, and interpretability in vertical domains. Traditional preference alignment methods like Reinforcemen…