Publications (34)
High-throughput relation extraction algorithm development associating knowledge articles and electronic health records
Yucong Lin, Keming Lu, Yulin Chen +2
Qwen2 Technical Report
An Yang, Baosong Yang, Binyuan Hui +59
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
An Yang, Beichen Zhang, Binyuan Hui +13
ProcessBench: Identifying Process Errors in Mathematical Reasoning
Chujie Zheng, Zhenru Zhang, Beichen Zhang +6
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
Guanting Dong, Keming Lu, Chengpeng Li +4
Speculative Contrastive Decoding
Hongyi Yuan, Keming Lu, Fei Huang +2
A Unified View of Delta Parameter Editing in Post-Trained Large-Scale Models
Qiaoyu Tang, Le Yu, Bowen Yu +5
Routing to the Expert: Efficient Reward-guided Ensemble of Large Language Models
Keming Lu, Hongyi Yuan, Runji Lin +4
Qwen Technical Report
Jinze Bai, Shuai Bai, Yunfei Chu +45
PIVOINE: Instruction Tuning for Open-world Information Extraction
Keming Lu, Xiaoman Pan, Kaiqiang Song +3
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
Guanting Dong, Hongyi Yuan, Keming Lu +7
Predicting Rewards Alongside Tokens: Non-disruptive Parameter Insertion for Efficient Inference Intervention in Large Language Model
Chenhan Yuan, Fei Huang, Ru Peng +4
Summarization as Indirect Supervision for Relation Extraction
Keming Lu, I-Hung Hsu, Wenxuan Zhou +2
Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment
Keming Lu, Bowen Yu, Fei Huang +3
Towards Scalable Automated Alignment of LLMs: A Survey
Boxi Cao, Keming Lu, Xinyu Lu +10
#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models
Keming Lu, Hongyi Yuan, Zheng Yuan +5
WorldPM: Scaling Human Preference Modeling
Binghai Wang, Runji Lin, Keming Lu +17
Multimodal Learning on Graphs for Disease Relation Extraction
Yucong Lin, Keming Lu, Sheng Yu +2
Qwen2.5-Coder Technical Report
Binyuan Hui, Jian Yang, Zeyu Cui +21
LLM Critics Help Catch Bugs in Mathematics: Towards a Better Mathematical Verifier with Natural Language Feedback
Bofei Gao, Zefan Cai, Runxin Xu +10
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
Qin Zhu, Fei Huang, Runyu Peng +6
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
Chengpeng Li, Zheng Yuan, Hongyi Yuan +6
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
Keming Lu, Bowen Yu, Chang Zhou +1
Towards a Unified View of Preference Learning for Large Language Models: A Survey
Bofei Gao, Feifan Song, Yibo Miao +22
Qwen2.5 Technical Report
Qwen, :, An Yang +41
Self-Evolved Diverse Data Sampling for Efficient Instruction Tuning
Shengguang Wu, Keming Lu, Benfeng Xu +3
Scaling Relationship on Learning Mathematical Reasoning with Large Language Models
Zheng Yuan, Hongyi Yuan, Chengpeng Li +5
Multi-hop Evidence Retrieval for Cross-document Relation Extraction
Keming Lu, I-Hung Hsu, Wenxuan Zhou +2
MARGE: Improving Math Reasoning for LLMs with Guided Exploration
Jingyue Gao, Runji Lin, Keming Lu +3
Exploring Partial Knowledge Base Inference in Biomedical Entity Linking
Hongyi Yuan, Keming Lu, Zheng Yuan
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
Hao Xiang, Bowen Yu, Hongyu Lin +7
Knowledge-Enhanced Relation Extraction Dataset
Yucong Lin, Hongming Xiao, Jiani Liu +4
PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling
Zefan Cai, Yichi Zhang, Bofei Gao +8
BIOS: An Algorithmically Generated Biomedical Knowledge Graph
Sheng Yu, Zheng Yuan, Jun Xia +11