collaborators

11 papers

cs.SE2026

From Fragments to Paths: Task-Level Context Recovery for Large Industrial Codebases

Jiawei He, Weisong Sun, Mengyu Shi +4

Large language models have shown strong performance on software engineering (SE) tasks, yet understanding large industrial repositories remains challenging. Existing methods often…

cs.CL2026

SSDAU: Structured Semantic Data Augmentation for Joint Entity and Relation Extraction

Jiawei He, Mengyu Shi, Jiawei Liu +6

Joint Entity and Relation Extraction (JERE) is highly sensitive to training data quality, making data augmentation a natural way to improve generalization. However, existing augmen…

cs.SE2026

ProcCtrlBench: Evaluating Process-Level Defects and Control Preservation in LLM Coding Agents

Jiawei He, Jie Jia, Chenbo Liu +4

Existing benchmarks for LLM coding agents primarily evaluate final outcomes. While useful for measuring overall capability, these metrics provide limited visibility and often miss…

cs.CV2026

SurgLQA: Scalable Long-Horizon Surgical Video Question Answering

Diandian Guo, Xikai Yang, Ruiyang Li +2

Surgical Video Question Answering (VideoQA) provides a promising paradigm for dynamic intraoperative interpretation, enabling real-time decision support and context-aware retrieval…

cs.CV2026

Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models

Dunyuan Xu, Xikai Yang, Juzheng Miao +3

Medical Multimodal Large Language Models (MLLMs) have demonstrated remarkable capabilities across diverse healthcare tasks. However, current post-training strategies, such as super…

cs.LG2026

CaliCausalRank: Calibrated Multi-Objective Ad Ranking with Robust Counterfactual Utility Optimization

Xikai Yang, Sebastian Sun, Yilin Li +3

Ad ranking systems must simultaneously optimize multiple objectives including click-through rate (CTR), conversion rate (CVR), revenue, and user experience metrics. However, produc…