papers

Publications (51)

cs.AI2026

Adaptive Robust Estimator for Multi-Agent Reinforcement Learning

Zhongyi Li, Wan Tian, Jingyu Chen +8

cs.LG2025

LLMBoost: Make Large Language Models Stronger with Boosting

Zehao Chen, Tianxiang Ai, Yifei Li +11

cs.LG2025

LLM-Forest: Ensemble Learning of LLMs with Graph-Augmented Prompts for Data Imputation

Xinrui He, Yikun Ban, Jiaru Zou +3

cs.LG2026

MasFACT: Continual Multi-Agent Topology Learning via Geometry-Aware Posterior Transfer

Xuefei Wang, Jialu Wang, Fengbo Zhang +6

cs.LG2026

GCL-OT: Graph Contrastive Learning with Optimal Transport for Heterophilic Text-Attributed Graphs

Yating Ren, Yikun Ban, Huobin Tan

cs.CL2026

Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process

Zhijun Chen, Zeyu Ji, Qianren Mao +12

cs.LG2026

Neural Exploitation and Exploration of Contextual Bandits

Yikun Ban, Yuchen Yan, Arindam Banerjee +1

cs.LG2020

Generic Outlier Detection in Multi-Armed Bandit

Yikun Ban, Jingrui He

cs.AI2026

Counterfactual Credit Policy Optimization for Multi-Agent Collaboration

Zhongyi Li, Wan Tian, Jinju Chen +4

cs.CL2025

Transformer Copilot: Learning from The Mistake Log in LLM Fine-tuning

Jiaru Zou, Yikun Ban, Zihao Li +4

cs.LG2023

Local Clustering in Contextual Multi-Armed Bandits

Yikun Ban, Jingrui He

cs.LG2026

Policy Improvement Reinforcement Learning

Huaiyang Wang, Xiaojie Li, Xiaohan Wang +10

cs.LG2025

Can Graph Neural Networks Learn Language with Extremely Weak Text Supervision?

Zihao Li, Lecheng Zheng, Bowen Jin +5

cs.RO2026

Frequency-Aware Flow Matching for Continuous and Consistent Robotic Action Generation

Jianing Guo, Fangzheng Chen, Zihao Mao +12

cs.LG2026

Adaptive Batch-Wise Sample Scheduling for Direct Preference Optimization

Zixuan Huang, Yikun Ban, Lean Fu +4

cs.LG2022

Convolutional Neural Bandit for Visual-aware Recommendation

Yikun Ban, Jingrui He

cs.LG2026

T-POP: Test-Time Personalization with Online Preference Feedback

Zikun Qu, Min Zhang, Mingze Kong +7

cs.IR2024

Logic Query of Thoughts: Guiding Large Language Models to Answer Complex Logic Queries with Knowledge Graphs

Lihui Liu, Zihao Wang, Ruizhong Qiu +5

cs.LG2023

Improved Algorithms for Neural Active Learning

Yikun Ban, Yuheng Zhang, Hanghang Tong +2

cs.DS2019

No Place to Hide: Catching Fraudulent Entities in Tensors

Yikun Ban, Xin Liu, Yitao Duan +2

cs.DC2019

Coalesced TLB to Exploit Diverse Contiguity of Memory Mapping

Yikun Ban, Yuchen Zhou, Xu Cheng +1

cs.LG2022

DISCO: Comprehensive and Explainable Disinformation Detection

Dongqi Fu, Yikun Ban, Hanghang Tong +2

cs.CL2026

Multi-Objective Exploration and Preference Optimization via Mutual Information

Hongyan Xie, Yikun Ban, Ruiyu Fang +4

cs.CL2025

Mitigating Spurious Correlations Between Question and Answer via Chain-of-Thought Correctness Perception Distillation

Hongyan Xie, Yitong Yao, Yikun Ban +6

cs.LG2025

FedPOB: Sample-Efficient Federated Prompt Optimization via Bandits

Pingchen Lu, Zhi Hong, Zhiwei Shang +6

cs.LG2026

When Self-Belief Misleads: Active Label Acquisition for Reinforcement Learning with Verifiable Rewards

Li Wang, Xiaodong Lu, Xiaohan Wang +5

cs.LG2022

Neural Collaborative Filtering Bandits via Meta Learning

Yikun Ban, Yunzhe Qi, Tianxin Wei +1

cs.SI2018

Catching Loosely Synchronized Behavior in Face of Camouflage

Yikun Ban, Jiao Sun, Xin Liu

cs.LG2024

Neural Active Learning Beyond Bandits

Yikun Ban, Ishika Agarwal, Ziwei Wu +4

cs.LG2022

EE-Net: Exploitation-Exploration Neural Networks in Contextual Bandits

Yikun Ban, Yuchen Yan, Arindam Banerjee +1

cs.AI2026

Real-Time Aligned Reward Model beyond Semantics

Zixuan Huang, Xin Xia, Yuxi Ren +10

cs.CL2026

Harnessing Multiple Large Language Models: A Survey on LLM Ensemble

Zhijun Chen, Xiaodong Lu, Jingzheng Li +12

cs.LG2023

Contextual Bandits with Online Neural Regression

Rohan Deb, Yikun Ban, Shiliang Zuo +2

cs.IR2026

UniFAR: A Unified Facet-Aware Retrieval Framework for Scientific Documents

Zheng Dou, Zhao Zhang, Deqing Wang +2

cs.LG2021

Multi-facet Contextual Bandits: A Neural Network Perspective

Yikun Ban, Jingrui He, Curtiss B. Cook

cs.LG2023

Graph Neural Bandits

Yunzhe Qi, Yikun Ban, Jingrui He

cs.LG2026

Heterogeneous Agent Collaborative Reinforcement Learning

Zhixia Zhang, Zixuan Huang, Gongxun Li +10

cs.DS2018

On Finding Dense Subgraphs in Bipartite Graphs: Linear Algorithms

Yikun Ban

cs.AI2026

Federated Reasoning Distillation Framework with Model Learnability-Aware Data Allocation

Wei Guo, Siyuan Lu, Xiangdong Ran +8

cs.LG2024

Meta Clustering of Neural Bandits

Yikun Ban, Yunzhe Qi, Tianxin Wei +2

cs.CR2018

BadLink: Combining Graph and Information-Theoretical Features for Online Fraud Group Detection

Yikun Ban, Xin Liu, Tianyi Zhang +4

cs.CL2026

UniARM: Towards a Unified Autoregressive Reward Model for Multi-Objective Test-Time Alignment

Hongyan Xie, Yikun Ban, Ruiyu Fang +6

cs.AI2026

Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs

Zixuan Huang, Yang Zhou, Kaixuan Wang +7

cs.AI2026

Weak-Driven Learning: How Weak Agents make Strong Agents Stronger

Zehao Chen, Gongxun Li, Tianxiang Ai +9

cs.AI2026

Does Your Reasoning Model Implicitly Know When to Stop Thinking?

Zixuan Huang, Xin Xia, Yuxi Ren +11

cs.LG2022

Neural Bandit with Arm Group Graph

Yunzhe Qi, Yikun Ban, Jingrui He

cs.LG2026

Your Group-Relative Advantage Is Biased

Fengkai Yang, Zherui Chen, Xiaohan Wang +10

cs.AI2026

CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling

Dengcan Liu, Fengkai Yang, Xiaohan Wang +7

cs.LG2026

Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards

Xiaodong Lu, Xiaohan Wang, Jiajun Chai +7

cs.LG2024

PageRank Bandits for Link Prediction

Yikun Ban, Jiaru Zou, Zihao Li +5

cs.IR2023

Neural Contextual Bandits for Personalized Recommendation

Yikun Ban, Yunzhe Qi, Jingrui He