papers

Publications (17)

cs.CL2025

FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning

Shaoyu Dou, Yutian Shen, Mofan Chen +9

cs.CL2026

Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

Kailin Jiang, Lei Liu, Jian Xi +8

cs.LG2026

Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning

Zekai Lin, Chao Xue, Di Liang +8

cs.CL2024

The Real, the Better: Aligning Large Language Models with Online Human Behaviors

Guanying Jiang, Lingyong Yan, Haibo Shi +1

cs.CR2026

When Safety Becomes a Vulnerability: Exploiting LLM Alignment Homogeneity for Transferable Blocking in RAG

Junchen Li, Chao Qi, Rongzheng Wang +7

cs.CL2026

Reason Only When Needed: Efficient Generative Reward Modeling via Model-Internal Uncertainty

Chao Xue, Yao Wang, Mengqiao Liu +11

cs.CL2026

Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models

Chao Xue, Yao Wang, Mengqiao Liu +11

cs.LG2025

HG2P: Hippocampus-inspired High-reward Graph and Model-Free Q-Gradient Penalty for Path Planning and Motion Control

Haoran Wang, Yaoru Sun, Zeshen Tang +2

cs.CL2024

ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator

Junda Zhu, Lingyong Yan, Haibo Shi +2

cs.CL2024

KnowTuning: Knowledge-aware Fine-tuning for Large Language Models

Yougang Lyu, Lingyong Yan, Shuaiqiang Wang +6

cs.CV2023

LOIS: Looking Out of Instance Semantics for Visual Question Answering

Siyu Zhang, Yeming Chen, Yaoru Sun +3

cs.CL2024

GOVERN: Gradient Orientation Vote Ensemble for Multi-Teacher Reinforced Distillation

Wenjie Zhou, Zhenxin Ding, Xiaodong Zhang +3

cs.AI2018

Research on Limited Buffer Scheduling Problems in Flexible Flow Shops with Setup Times

Zhonghua Han, Quan Zhang, Haibo Shi +2

cs.IR2026

Training Documents Reranker with Search Rubrics for Deep Research Agent

Wenhan Liu, Yu Lu, Qiaolin Xia +8

cs.CL2024

Learning to Use Tools via Cooperative and Interactive Agents

Zhengliang Shi, Shen Gao, Xiuyi Chen +7

cs.AI2026

OPOD: On-Policy Omni Distillation

Tong Zhao, Yuyang Hu, Reed Li +5

eess.IV2025

A Dual-Task Synergy-Driven Generalization Framework for Pancreatic Cancer Segmentation in CT Scans

Jun Li, Yijue Zhang, Haibo Shi +3