papers
Publications (10)
cs.CV2025
MedConv: Convolutions Beat Transformers on Long-Tailed Bone Density Prediction
Xuyin Qi, Zeyu Zhang, Huazhan Zheng +19
cs.CL2026
MedPRMBench: A Fine-grained Benchmark for Process Reward Models in Medical Reasoning
Lingyan Wu, Xiang Zheng, Weiqi Zhai +5
cs.AI2026
Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs
Xiang Zheng, Weiqi Zhai, Wei Wang +15
cs.AI2026
Agentic Proposing: Enhancing Large Language Model Reasoning via Compositional Skill Synthesis
Zhengbo Jiao, Shaobo Wang, Zifan Zhang +5
cs.CL2023
Out-of-Distribution Generalization in Text Classification: Past, Present, and Future
Linyi Yang, Yaoxiao Song, Xuan Ren +6
cs.CL2025
You Can Generate It Again: Data-to-Text Generation with Verification and Correction Prompting
Xuan Ren, Zeyu Zhang, Lingqiao Liu
cs.LG2026
Discovering Millions of Interpretable Features with Sparse Autoencoders
XinYang He, Wei Wang, Bing Zhao +5
cs.CL2025
I Learn Better If You Speak My Language: Understanding the Superior Performance of Fine-Tuning Large Language Models with LLM-Generated Responses
Xuan Ren, Biao Wu, Lingqiao Liu
cs.CL2025
Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity
Xuan Ren, Qi Chen, Lingqiao Liu
cs.AI2026
Right Answer, Wrong Method: Shortcut Hacking Misleads the Evaluation of LLM Reasoning on Frontier Science Benchmarks
Xuan Ren, Weiqi Zhai, Tianle Pu +3