papers

Publications (34)

cs.LG2020

High-throughput relation extraction algorithm development associating knowledge articles and electronic health records

Yucong Lin, Keming Lu, Yulin Chen +2

cs.CL2024

Qwen2 Technical Report

An Yang, Baosong Yang, Binyuan Hui +59

cs.CL2024

Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement

An Yang, Beichen Zhang, Binyuan Hui +13

cs.AI2025

ProcessBench: Identifying Process Errors in Mathematical Reasoning

Chujie Zheng, Zhenru Zhang, Beichen Zhang +6

cs.CL2024

Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models

Guanting Dong, Keming Lu, Chengpeng Li +4

cs.CL2024

Speculative Contrastive Decoding

Hongyi Yuan, Keming Lu, Fei Huang +2

cs.LG2024

A Unified View of Delta Parameter Editing in Post-Trained Large-Scale Models

Qiaoyu Tang, Le Yu, Bowen Yu +5

cs.CL2023

Routing to the Expert: Efficient Reward-guided Ensemble of Large Language Models

Keming Lu, Hongyi Yuan, Runji Lin +4

cs.CL2023

Qwen Technical Report

Jinze Bai, Shuai Bai, Yunfei Chu +45

cs.CL2023

PIVOINE: Instruction Tuning for Open-world Information Extraction

Keming Lu, Xiaoman Pan, Kaiqiang Song +3

cs.CL2024

How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition

Guanting Dong, Hongyi Yuan, Keming Lu +7

cs.CL2024

Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model

Chenhan Yuan, Fei Huang, Ru Peng +4

cs.CL2022

Summarization as Indirect Supervision for Relation Extraction

Keming Lu, I-Hung Hsu, Wenxuan Zhou +2

cs.CL2024

Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment

Keming Lu, Bowen Yu, Fei Huang +3

cs.CL2024

Towards Scalable Automated Alignment of LLMs: A Survey

Boxi Cao, Keming Lu, Xinyu Lu +10

cs.CL2023

#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models

Keming Lu, Hongyi Yuan, Zheng Yuan +5

cs.CL2025

WorldPM: Scaling Human Preference Modeling

Binghai Wang, Runji Lin, Keming Lu +17

cs.LG2022

Multimodal Learning on Graphs for Disease Relation Extraction

Yucong Lin, Keming Lu, Sheng Yu +2

cs.CL2024

Qwen2.5-Coder Technical Report

Binyuan Hui, Jian Yang, Zeyu Cui +21

cs.CL2024

LLM Critics Help Catch Bugs in Mathematics: Towards a Better Mathematical Verifier with Natural Language Feedback

Bofei Gao, Zefan Cai, Runxin Xu +10

cs.CL2025

AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models

Qin Zhu, Fei Huang, Runyu Peng +6

cs.CL2024

MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning

Chengpeng Li, Zheng Yuan, Hongyi Yuan +6

cs.CL2024

Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment

Keming Lu, Bowen Yu, Chang Zhou +1

cs.CL2024

Towards a Unified View of Preference Learning for Large Language Models: A Survey

Bofei Gao, Feifan Song, Yibo Miao +22

cs.CL2025

Qwen2.5 Technical Report

Qwen, :, An Yang +41

cs.CL2023

Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning

Shengguang Wu, Keming Lu, Benfeng Xu +3

cs.CL2023

Scaling Relationship on Learning Mathematical Reasoning with Large Language Models

Zheng Yuan, Hongyi Yuan, Chengpeng Li +5

cs.CL2023

Multi-hop Evidence Retrieval for Cross-document Relation Extraction

Keming Lu, I-Hung Hsu, Wenxuan Zhou +2

cs.AI2025

MARGE: Improving Math Reasoning for LLMs with Guided Exploration

Jingyue Gao, Runji Lin, Keming Lu +3

cs.CL2023

Exploring Partial Knowledge Base Inference in Biomedical Entity Linking

Hongyi Yuan, Keming Lu, Zheng Yuan

cs.CL2025

Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models

Hao Xiang, Bowen Yu, Hongyu Lin +7

cs.LG2023

Knowledge-Enhanced Relation Extraction Dataset

Yucong Lin, Hongming Xiao, Jiani Liu +4

cs.CL2025

PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling

Zefan Cai, Yichi Zhang, Bofei Gao +8

cs.CL2022

BIOS: An Algorithmically Generated Biomedical Knowledge Graph

Sheng Yu, Zheng Yuan, Jun Xia +11