papers

Publications (250)

cs.CL2025

Agent KB: Leveraging Cross-Domain Experience for Agentic Problem Solving

Xiangru Tang, Tianrui Qin, Tianhao Peng +15

cs.CV2021

Exploring Dynamic Context for Multi-path Trajectory Prediction

Hao Cheng, Wentong Liao, Xuejiao Tang +3

cs.RO2024

Data-Driven Dynamics Modeling of Miniature Robotic Blimps Using Neural ODEs With Parameter Auto-Tuning

Yongjian Zhu, Hao Cheng, Feitian Zhang

cs.CL2023

Chain-of-Skills: A Configurable Model for Open-domain Question Answering

Kaixin Ma, Hao Cheng, Yu Zhang +3

cs.LG2022

Learning with Noisy Labels Revisited: A Study Using Real-World Human Annotations

Jiaheng Wei, Zhaowei Zhu, Hao Cheng +3

cs.LG2026

Latent Recurrent Transformer: Architecture Exploration, Training Strategies, and Scaling Behavior

Zeyi Huang, Xuehai He, LiLiang Ren +8

q-bio.BM2024

AdaMR: Adaptable Molecular Representation for Unified Pre-training Strategy

Yan Ding, Hao Cheng, Ziliang Ye +5

cs.CV2023

A Novel Multi-Task Model Imitating Dermatologists for Accurate Differential Diagnosis of Skin Diseases in Clinical Images

Yan-Jie Zhou, Wei Liu, Yuan Gao +8

cs.SI2016

Learning Latent Local Conversation Modes for Predicting Community Endorsement in Online Discussions

Hao Fang, Hao Cheng, Mari Ostendorf

cs.CV2025

Exploring Typographic Visual Prompts Injection Threats in Cross-Modality Generation Models

Hao Cheng, Erjia Xiao, Yichi Wang +8

cs.CV2024

ACT-Diffusion: Efficient Adversarial Consistency Training for One-step Diffusion Models

Fei Kong, Jinhao Duan, Lichao Sun +6

cs.AI2025

Understanding Driver Cognition and Decision-Making Behaviors in High-Risk Scenarios: A Drift Diffusion Perspective

Heye Huang, Zheng Li, Hao Cheng +4

cs.CV2026

TruthPrInt: Mitigating Large Vision-Language Models Object Hallucination Via Latent Truthful-Guided Pre-Intervention

Jinhao Duan, Fei Kong, Hao Cheng +6

cs.CV2025

Occupancy World Model for Robots

Zhang Zhang, Qiang Zhang, Wei Cui +12

cs.IR2026

LEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval

Mike Hang Wang, Utkarsh Garg, Reza Davari +5

physics.class-ph2025

Determining the acoustoelastic effect of longitudinal waves propagating inclined to principal stress directions in concrete: theory and experimental validation

Hao Cheng, Katrin Löer, Max A. N. Hendriks +1

cs.CV2023

ForceFormer: Exploring Social Force and Transformer for Pedestrian Trajectory Prediction

Weicheng Zhang, Hao Cheng, Fatema T. Johora +1

cs.CL2022

Knowledge-Rich Self-Supervision for Biomedical Entity Linking

Sheng Zhang, Hao Cheng, Shikhar Vashishth +6

cs.SD2026

Jailbreak-AudioBench: In-Depth Evaluation and Analysis of Jailbreak Threats for Large Audio Language Models

Hao Cheng, Erjia Xiao, Jing Shao +6

cs.LG2025

ThetaEvolve: Test-time Learning on Open Problems

Yiping Wang, Shao-Rong Su, Zhiyuan Zeng +13

cs.LG2024

Reassessing Layer Pruning in LLMs: New Insights and Methods

Yao Lu, Hao Cheng, Yujie Fang +6

cs.CV2025

T-Graph: Enhancing Sparse-view Camera Pose Estimation by Pairwise Translation Graph

Qingyu Xian, Weiqin Jiao, Hao Cheng +2

cs.AI2025

LinguaSim: Interactive Multi-Vehicle Testing Scenario Generation via Natural Language Instruction Based on Large Language Models

Qingyuan Shi, Qingwen Meng, Hao Cheng +2

cs.AI2025

CollabLLM: From Passive Responders to Active Collaborators

Shirley Wu, Michel Galley, Baolin Peng +7

cs.DC2022

Leopard: Towards High Throughput-Preserving BFT for Large-scale Systems

Kexin Hu, Kaiwen Guo, Qiang Tang +3

cs.RO2026

Disturbance-Aware Flight Control of Robotic Gliding Blimp via Moving Mass Actuation

Hao Cheng, Feitian Zhang

cs.CL2026

Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning

Jinlong Pang, Na Di, Zhaowei Zhu +4

cs.RO2026

Compose Your Policies! Improving Diffusion-based or Flow-based Robot Policies via Test-time Distribution-level Composition

Jiahang Cao, Yize Huang, Hanzhong Guo +15

cs.AI2026

Orchard: An Open-Source Agentic Modeling Framework

Baolin Peng, Wenlin Yao, Qianhui Wu +11

cs.LG2025

Noise-Resilient Point-wise Anomaly Detection in Time Series Using Weak Segment Labels

Yaxuan Wang, Hao Cheng, Jing Xiong +6

cs.LG2024

Mamba as Decision Maker: Exploring Multi-scale Sequence Modeling in Offline Reinforcement Learning

Jiahang Cao, Qiang Zhang, Ziqing Wang +8

cs.IR2021

Domain-Specific Pretraining for Vertical Search: Case Study on Biomedical Literature

Yu Wang, Jinchao Li, Tristan Naumann +12

cs.CV2021

Disentangled Feature Representation for Few-shot Image Classification

Hao Cheng, Yufei Wang, Haoliang Li +2

cs.AI2025

Boosting Private Domain Understanding of Efficient MLLMs: A Tuning-free, Adaptive, Universal Prompt Optimization Framework

Jiang Liu, Bolin Li, Haoyuan Li +13

physics.class-ph2025

Determining diffusivity and dissipation of diffuse body waves in concrete with multiple planar boundaries

Hao Cheng, Katrin Löer, Max A. N. Hendriks +1

cs.CV2025

Spiking Neural Network as Adaptive Event Stream Slicer

Jiahang Cao, Mingyuan Sun, Ziqing Wang +4

cs.CV2024

RoIPoly: Vectorized Building Outline Extraction Using Vertex and Logit Embeddings

Weiqin Jiao, Hao Cheng, Claudio Persello +1

cs.CV2025

Transfer Attack for Bad and Good: Explain and Boost Adversarial Transferability across Multimodal Large Language Models

Hao Cheng, Erjia Xiao, Jiayan Yang +8

cs.CV2026

UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation

Mengmeng Liu, Diankun Zhang, Jiuming Liu +7

cs.RO2025

Controllable Traffic Simulation through LLM-Guided Hierarchical Reasoning and Refinement

Zhiyuan Liu, Leheng Li, Yuning Wang +5

cs.LG2024

LoRC: Low-Rank Compression for LLMs KV Cache with a Progressive Compression Strategy

Rongzhi Zhang, Kuang Wang, Liyuan Liu +4

cs.LG2019

Many could be better than all: A novel instance-oriented algorithm for Multi-modal Multi-label problem

Yi Zhang, Cheng Zeng, Hao Cheng +2

cs.CL2023

Evaluating the Efficacy of Length-Controllable Machine Translation

Hao Cheng, Meng Zhang, Weixuan Wang +3

cs.CV2021

Interaction Detection Between Vehicles and Vulnerable Road Users: A Deep Generative Approach with Attention

Hao Cheng, Li Feng, Hailong Liu +3

cs.CL2026

AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation

Xianyang Liu, Yilin Liu, Shuai Wang +5

cs.CV2025

A Foundation Model for Spatial Proteomics

Muhammad Shaban, Yuzhou Chang, Huaying Qiu +57

cs.LG2022

Mitigating Memorization of Noisy Labels via Regularization between Representations

Hao Cheng, Zhaowei Zhu, Xing Sun +1

cs.CV2021

RMNet: Equivalently Removing Residual Connection from Networks

Fanxu Meng, Hao Cheng, Jiaxin Zhuang +2

cs.CL2024

Pre-training, Fine-tuning and Re-ranking: A Three-Stage Framework for Legal Question Answering

Shiwen Ni, Hao Cheng, Min Yang

cs.CV2023

RBFormer: Improve Adversarial Robustness of Transformer by Robust Bias

Hao Cheng, Jinhao Duan, Hui Li +6

math.NT2026

On the geometry of the second Lagrange spectra

Hao Cheng, Harold Erazo, Carlos Gustavo Moreira +1

cs.NE2023

Spiking Denoising Diffusion Probabilistic Models

Jiahang Cao, Ziqing Wang, Hanzhong Guo +3

cs.LG2026

CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies

Keyu Chen, Nanfei Ye, Yida Wang +4

cs.CL2023

Augmenting Language Models with Long-Term Memory

Weizhi Wang, Li Dong, Hao Cheng +4

cs.CR2025

Defending against Backdoor Attack on Deep Neural Networks

Hao Cheng, Kaidi Xu, Sijia Liu +3

cs.CL2022

Open-domain Question Answering via Chain of Reasoning over Heterogeneous Knowledge

Kaixin Ma, Hao Cheng, Xiaodong Liu +2

cs.RO2025

LiPS: Large-Scale Humanoid Robot Reinforcement Learning with Parallel-Series Structures

Qiang Zhang, Gang Han, Jingkai Sun +7

cs.CV2024

MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts

Pan Lu, Hritik Bansal, Tony Xia +7

physics.flu-dyn2024

Thermal Stress Analysis of the LNG Corrugated Cryogenic Hose During Gas Pre-Cooling Process

Miaoer Liu, Fangqiu Li, Hao Cheng +6

cs.CV2023

Variational Disentanglement for Domain Generalization

Yufei Wang, Haoliang Li, Hao Cheng +3

cs.DC2024

JUMBO: Fully Asynchronous BFT Consensus Made Truly Scalable

Hao Cheng, Yuan Lu, Zhenliang Lu +3

cs.CL2025

On Memory Construction and Retrieval for Personalized Conversational Agents

Zhuoshi Pan, Qianhui Wu, Huiqiang Jiang +8

cs.CL2021

Domain-Specific Language Model Pretraining for Biomedical Natural Language Processing

Yu Gu, Robert Tinn, Hao Cheng +6

cs.CV2024

D2E-An Autonomous Decision-making Dataset involving Driver States and Human Evaluation

Zehong Ke, Yanbo Jiang, Yuning Wang +3

cs.CL2024

Efficient Encoder-Decoder Transformer Decoding for Decomposable Tasks

Bo-Ru Lu, Nikita Haduong, Chien-Yu Lin +3

cs.CV2024

DyFADet: Dynamic Feature Aggregation for Temporal Action Detection

Le Yang, Ziwei Zheng, Yizeng Han +4

cs.CV2023

LLaVA-Plus: Learning to Use Tools for Creating Multimodal Agents

Shilong Liu, Hao Cheng, Haotian Liu +10

cs.CL2023

Pre-training Transformers for Knowledge Graph Completion

Sanxing Chen, Hao Cheng, Xiaodong Liu +3

cs.CL2022

Unsupervised Learning of Hierarchical Conversation Structure

Bo-Ru Lu, Yushi Hu, Hao Cheng +2

cs.CV2025

ChartM: A Multi-Stage Code-Driven Pipeline for Constructing Multi-Dimensional and Multi-Step Visual Reasoning Data in Chart Comprehension

Duo Xu, Hao Cheng, Xin Lin +2

cs.CL2026

The Tool Illusion: Rethinking Tool Use in Web Agents

Renze Lou, Baolin Peng, Wenlin Yao +5

The paper presents a large, controlled empirical study of tool use in web agents, examining how different tools, backbone models, and frameworks affect performance across multiple…

#web agents#tool use#empirical study#benchmark evaluation
cs.CV2023

Improve Video Representation with Temporal Adversarial Augmentation

Jinhao Duan, Quanfu Fan, Hao Cheng +2

cs.LG2023

LaplaceConfidence: a Graph-based Approach for Learning with Noisy Labels

Mingcai Chen, Yuntao Du, Wei Tang +4

cs.CL2020

The Microsoft Toolkit of Multi-Task Deep Neural Networks for Natural Language Understanding

Xiaodong Liu, Yu Wang, Jianshu Ji +8

cs.CL2023

INSCIT: Information-Seeking Conversations with Mixed-Initiative Interactions

Zeqiu Wu, Ryu Parish, Hao Cheng +4

physics.ins-det2020

Intrinsic radiation background of LaBr(Ce) detector via coincidence measurements and simulations

Hao Cheng, Bao-Hua Sun, Li-Hua Zhu +5

cs.CL2023

Self-Verification Improves Few-Shot Clinical Information Extraction

Zelalem Gero, Chandan Singh, Hao Cheng +4

cond-mat.str-el2026

Twisting-operator approach to identifying gaplessness in SU() fermionic systems

Hao Cheng, Hang Su, Yuan Yao

cs.LG2026

Self-Boosting Vision-Language Models with Noisy Student On-Policy Self-Distillation

Shuai Wang, Daoan Zhang, Zhe Tang +2

cs.CV2023

READ: Aggregating Reconstruction Error into Out-of-distribution Detection

Wenyu Jiang, Yuxin Ge, Hao Cheng +3

cs.RO2023

RGBlimp: Robotic Gliding Blimp -- Design, Modeling, Development, and Aerodynamics Analysis

Hao Cheng, Zeyu Sha, Yongjian Zhu +1

cs.CV2025

Gaussian On-the-Fly Splatting: A Progressive Framework for Robust Near Real-Time 3DGS Optimization

Yiwei Xu, Yifei Yu, Wentian Gan +4

cs.RO2026

RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation

Shihan Wu, Xuecheng Liu, Shaoxuan Xie +81

cs.CL2025

SAS: Simulated Attention Score

Chuanyang Zheng, Jiankai Sun, Yihang Gao +12

cs.GT2023

Exploring Leximin Principle for Fair Core-Selecting Combinatorial Auctions: Payment Rule Design and Implementation

Hao Cheng, Shufeng Kong, Yanchen Deng +4

nucl-ex2021

Measurements of Dy() at energies relevant for astrophysical process

Hao Cheng, Bao-Hua Sun, Li-Hua Zhu +20

cs.LG2026

TRACE: Turn-level Reward Assignment via Credit Estimation for Long-Horizon Agents

Leitian Tao, Baolin Peng, Wenlin Yao +5

The paper proposes TRACE, a turn-level reward assignment method that estimates credit for each tool-call in long-horizon agents using log‑ratio state values and temporal‑difference…

#credit assignment#long-horizon agents#tool use#dense rewards
cs.LG2021

Learning with Instance-Dependent Label Noise: A Sample Sieve Approach

Hao Cheng, Zhaowei Zhu, Xingyu Li +3

cs.CL2025

Dyna-Mind: Learning to Simulate from Experience for Better AI Agents

Xiao Yu, Baolin Peng, Michel Galley +6

cs.LG2025

Reinforcement Learning for Reasoning in Large Language Models with One Training Example

Yiping Wang, Qing Yang, Zhiyuan Zeng +11

cs.AI2023

TrainerAgent: Customizable and Efficient Model Training through LLM-Powered Multi-Agent System

Haoyuan Li, Hao Jiang, Tianke Zhang +6

cs.AI2024

ReasonAgain: Using Extractable Symbolic Programs to Evaluate Mathematical Reasoning

Xiaodong Yu, Ben Zhou, Hao Cheng +1

cs.CV2023

An End-to-End Framework of Road User Detection, Tracking, and Prediction from Monocular Images

Hao Cheng, Mengmeng Liu, Lin Chen

cs.CV2020

One for More: Selecting Generalizable Samples for Generalizable ReID Model

Enwei Zhang, Xinyang Jiang, Hao Cheng +7

cs.CV2021

An Empirical Study and Analysis on Open-Set Semi-Supervised Learning

Huixiang Luo, Hao Cheng, Fanxu Meng +4

cs.RO2023

Tracing the Influence of Predecessors on Trajectory Prediction

Mengmeng Liu, Hao Cheng, Michael Ying Yang

cs.AI2026

Synthetic Computers at Scale for Long-Horizon Productivity Simulation

Tao Ge, Baolin Peng, Hao Cheng +1

cs.CL2023

Optimizing Bi-Encoder for Named Entity Recognition via Contrastive Learning

Sheng Zhang, Hao Cheng, Jianfeng Gao +1

cs.CL2022

Human Parity on CommonsenseQA: Augmenting Self-Attention with External Attention

Yichong Xu, Chenguang Zhu, Shuohang Wang +7

cs.CL2025

MPL: Multiple Programming Languages with Large Language Models for Information Extraction

Bo Li, Gexiang Fang, Wei Ye +4