papers

Publications (383)

cs.DC2023

Helios: An Efficient Out-of-core GNN Training System on Terabyte-scale Graphs with In-memory Performance

Jie Sun, Mo Sun, Zheng Zhang +6

cs.CL2022

BertGCN: Transductive Text Classification by Combining GCN and BERT

Yuxiao Lin, Yuxian Meng, Xiaofei Sun +4

cs.DC2017

Designing Low-Complexity Heavy-Traffic Delay-Optimal Load Balancing Schemes: Theory to Algorithms

Xingyu Zhou, Fei Wu, Jian Tan +2

cs.CV2021

TRIE: End-to-End Text Reading and Information Extraction for Document Understanding

Peng Zhang, Yunlu Xu, Zhanzhan Cheng +5

cs.CL2022

A Unified MRC Framework for Named Entity Recognition

Xiaoya Li, Jingrong Feng, Yuxian Meng +4

cs.CL2020

SAC: Accelerating and Structuring Self-Attention via Sparse Adaptive Connection

Xiaoya Li, Yuxian Meng, Mingxin Zhou +3

cs.AI2025

OS Agents: A Survey on MLLM-based Agents for General Computing Devices Use

Xueyu Hu, Tao Xiong, Biao Yi +26

cs.LG2026

DAG-FM: A Foundation Model for Causal Discovery under Heterogeneous Causal Mechanisms

Yikang Chen, Zhengkang Guan, Haoyuan Qian +5

The paper presents DAG-FM, a transformer‑based foundation model that discovers causal directed acyclic graphs from tabular data by sequentially predicting leaf and parent nodes and…

#causal discovery#directed acyclic graphs#transformer models#heterogeneous causal mechanisms
cs.AI2026

ISEE: Interactive Semantic Enrichment for Database Fields

Yuan Tian, Yiru Chen, Rakesh R. Menon +8

cs.CV2026

Perception, Verdict, and Evolution: Hindsight-Driven Self-Refining Forensics Agent for AI-Generated Image Detection

Yangjun Wu, Keyu Yan, Yu Liu +5

cs.CV2022

Domain-Specific Bias Filtering for Single Labeled Domain Generalization

Junkun Yuan, Xu Ma, Defang Chen +3

cs.CV2021

Homogeneous and Heterogeneous Relational Graph for Visible-infrared Person Re-identification

Yujian Feng, Feng Chen, Jian Yu +4

cs.CV2018

Context-Aware Deep Spatio-Temporal Network for Hand Pose Estimation from Depth Images

Yiming Wu, Wei Ji, Xi Li +3

cs.CL2025

Instruction Tuning for Large Language Models: A Survey

Shengyu Zhang, Linfeng Dong, Xiaoya Li +8

cs.CV2021

MANGO: A Mask Attention Guided One-Stage Scene Text Spotter

Liang Qiao, Ying Chen, Zhanzhan Cheng +4

cs.CV2026

ClueAegis: Heuristic-to-Reasoning Cognitive-skill Learning for Unified Evidence-based Synthetic Image Detection

Huangsen Cao, Hongkang Chu, Yuxi Li +6

astro-ph.HE2016

Neutron stars including the effects of chaotic magnetic fields and the anomalous magnetic moments

Fei Wu, Chen Wu, Zhongzhou Ren

cs.CL2021

Modeling Text-visual Mutual Dependency for Multi-modal Dialog Generation

Shuhe Wang, Yuxian Meng, Xiaofei Sun +5

cs.CL2024

Causality for Large Language Models

Anpeng Wu, Kun Kuang, Minqin Zhu +7

cs.CV2024

MOSS: Motion-based 3D Clothed Human Synthesis from Monocular Video

Hongsheng Wang, Xiang Cai, Xi Sun +5

stat.ML2021

Parameter Estimation for the SEIR Model Using Recurrent Nets

Chun Fan, Yuxian Meng, Xiaofei Sun +3

cs.CV2017

Transductive Zero-Shot Learning with a Self-training dictionary approach

Yunlong Yu, Zhong Ji, Xi Li +4

cs.CL2023

Exploiting Contrastive Learning and Numerical Evidence for Confusing Legal Judgment Prediction

Leilei Gan, Baokui Li, Kun Kuang +5

cs.CL2021

OpenViDial: A Large-Scale, Open-Domain Dialogue Dataset with Visual Contexts

Yuxian Meng, Shuhe Wang, Qinghong Han +4

nucl-th2025

Antikaon condensation in magnetized neutron star matter within the framework of the -cut scheme

Fei Wu, Chen Wu

cs.CV2023

Collaborative Semantic Aggregation and Calibration for Federated Domain Generalization

Junkun Yuan, Xu Ma, Defang Chen +3

cs.CL2024

InfiAgent-DABench: Evaluating Agents on Data Analysis Tasks

Xueyu Hu, Ziyu Zhao, Shuang Wei +14

cs.CV2025

AMD-HookNet++: Evolution of AMD-HookNet with Hybrid CNN-Transformer Feature Enhancement for Glacier Calving Front Segmentation

Fei Wu, Marcel Dreier, Nora Gourmelon +6

cs.LG2026

Preventing Rank Collapse in Federated Low-Rank Adaptation with Client Heterogeneity

Fei Wu, Jia Hu, Geyong Min +1

cs.CV2020

Grounded and Controllable Image Completion by Incorporating Lexical Semantics

Shengyu Zhang, Tan Jiang, Qinghao Huang +7

cs.LG2018

State Distribution-aware Sampling for Deep Q-learning

Weichao Li, Fuxian Huang, Xi Li +2

cs.LG2021

Amazon SageMaker Model Parallelism: A General and Flexible Framework for Large Model Training

Can Karakus, Rahul Huilgol, Fei Wu +7

cs.CL2022

Investigating the Robustness of Natural Language Generation from Logical Forms via Counterfactual Samples

Chengyuan Liu, Leilei Gan, Kun Kuang +1

cs.CL2024

Training-free LLM-generated Text Detection by Mining Token Probability Sequences

Yihuai Xu, Yongwei Wang, Yifei Bi +4

cs.CV2022

DF-GAN: A Simple and Effective Baseline for Text-to-Image Synthesis

Ming Tao, Hao Tang, Fei Wu +3

cs.CV2021

ICDAR 2021 Competition on Scene Video Text Spotting

Zhanzhan Cheng, Jing Lu, Baorui Zou +2

cs.CL2026

InfiGFusion: Graph-on-Logits Distillation via Efficient Gromov-Wasserstein for Model Fusion

Yuanyi Wang, Zhaoyi Yan, Yiming Zhang +4

cs.LG2026

TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training

Jinluan Yang, Yuxin Liu, Zhengyu Chen +7

cs.LG2020

Balance-Subsampled Stable Prediction

Kun Kuang, Hengtao Zhang, Fei Wu +2

cs.LG2024

AuG-KD: Anchor-Based Mixup Generation for Out-of-Domain Knowledge Distillation

Zihao Tang, Zheqi Lv, Shengyu Zhang +4

cs.CL2023

GPT-NER: Named Entity Recognition via Large Language Models

Shuhe Wang, Xiaofei Sun, Xiaoya Li +5

cs.CV2026

Generalizable Detection of AI Generated Images with Large Models and Fuzzy Decision Tree

Fei Wu, Guanghao Ding, Zijian Niu +4

cs.CV2025

SSGaussian: Semantic-Aware and Structure-Preserving 3D Style Transfer

Jimin Xu, Bosheng Qin, Tao Jin +4

cs.CL2026

Step Potential Advantage Estimation: Harnessing Intermediate Confidence and Correctness for Efficient Mathematical Reasoning

Fei Wu, Zhenrong Zhang, Qikai Chang +3

cs.CL2024

More Than Catastrophic Forgetting: Integrating General Capabilities For Domain-Specific LLMs

Chengyuan Liu, Yangyang Kang, Shihang Wang +5

cs.CL2025

Dropping Experts, Recombining Neurons: Retraining-Free Pruning for Sparse Mixture-of-Experts LLMs

Yixiao Zhou, Ziyu Zhao, Dongzhou Cheng +6

cs.LG2019

Leveraging Model Interpretability and Stability to increase Model Robustness

Fei Wu, Thomas Michel, Alexandre Briot

cs.IR2024

Re4: Learning to Re-contrast, Re-attend, Re-construct for Multi-interest Recommendation

Shengyu Zhang, Lingxiao Yang, Dong Yao +5

cs.CL2025

Reinforcement Learning Enhanced LLMs: A Survey

Shuhe Wang, Shengyu Zhang, Jie Zhang +7

cs.IR2021

Why Do We Click: Visual Impression-aware News Recommendation

Jiahao Xun, Shengyu Zhang, Zhou Zhao +7

cs.CV2025

Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning

Wang Lin, Liyu Jia, Wentao Hu +6

cs.CV2024

MgSvF: Multi-Grained Slow vs. Fast Framework for Few-Shot Class-Incremental Learning

Hanbin Zhao, Yongjian Fu, Mintong Kang +3

cs.CV2022

Depth Estimation maps of lidar and stereo images

Fei Wu, Luoyu Chen

cs.CL2026

TACO: Task-Aware Column Description Generation Using LLMs

Ting Cai, Rakesh R. Menon, Yiru Chen +8

cs.CL2023

Precedent-Enhanced Legal Judgment Prediction with LLM and Domain-Model Collaboration

Yiquan Wu, Siying Zhou, Yifei Liu +6

cs.CV2022

Leaning Compact and Representative Features for Cross-Modality Person Re-Identification

Guangwei Gao, Hao Shao, Fei Wu +2

cs.CL2026

PoliLegalLM: A Technical Report on a Large Language Model for Political and Legal Affairs

Yuting Huang, Yinghao Hu, Qian Xiao +7

cs.CV2026

NTIRE 2026 Challenge on Robust AI-Generated Image Detection in the Wild

Aleksandr Gushchin, Khaled Abud, Ekaterina Shumitskaya +51

cs.CV2026

VLADriveBench: Evaluating CoT-Action Relationship in VLA for Autonomous Driving

Thach Nguyen, Danhua Guo, Tom Lampo +2

cs.CL2020

Self-Explaining Structures Improve NLP Models

Zijun Sun, Chun Fan, Qinghong Han +4

cs.IR2023

Denoising Multi-modal Sequential Recommenders with Contrastive Learning

Dong Yao, Shengyu Zhang, Zhou Zhao +5

cs.CV2015

Hierarchical Recurrent Neural Encoder for Video Representation with Application to Captioning

Pingbo Pan, Zhongwen Xu, Yi Yang +2

cs.CL2018

A Semantic QA-Based Approach for Text Summarization Evaluation

Ping Chen, Fei Wu, Tong Wang +1

cs.CL2023

RexUIE: A Recursive Method with Explicit Schema Instructor for Universal Information Extraction

Chengyuan Liu, Fubang Zhao, Yangyang Kang +5

eess.IV2022

Boosting RGB-D Saliency Detection by Leveraging Unlabeled RGB Images

Xiaoqiang Wang, Lei Zhu, Siliang Tang +5

cs.CV2020

Refined Gate: A Simple and Effective Gating Mechanism for Recurrent Units

Zhanzhan Cheng, Yunlu Xu, Mingjian Cheng +4

cs.CV2020

Unsupervised Reinforcement Learning of Transferable Meta-Skills for Embodied Navigation

Juncheng Li, Xin Wang, Siliang Tang +4

cs.CV2020

Query Attack via Opposite-Direction Feature:Towards Robust Image Retrieval

Zhedong Zheng, Liang Zheng, Yi Yang +1

cs.IT2018

High Throughput Low Delay Wireless Multicast via Multi-Channel Moving Window Codes

Fei Wu, Yin Sun, Lu Chen +3

cs.CV2026

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark

Wang Lin, Feng Wang, Majun Zhang +7

cs.AI2025

InfiGUI-G1: Advancing GUI Grounding with Adaptive Exploration Policy Optimization

Yuhang Liu, Zeyu Liu, Shuanghe Zhu +10

cs.CV2023

MEDOE: A Multi-Expert Decoder and Output Ensemble Framework for Long-tailed Semantic Segmentation

Junao Shen, Long Chen, Kun Kuang +3

cs.CV2026

ICDAR 2026 Competition on Writer Identification and Pen Classification from Hand-Drawn Circles

Thomas Gorges, Janne van der Loop, Lukas Hüttner +4

cs.CV2026

Cascade-Free Mandarin Visual Speech Recognition via Semantic-Guided Cross-Representation Alignment

Lei Yang, Yi He, Fei Wu +1

cs.GT2025

From Competition to Centralization: The Oligopoly in Ethereum Block Building Auctions

Fei Wu, Thomas Thiery, Stefanos Leonardos +1

cs.IR2024

Fine-Grained Guidance for Retrievers: Leveraging LLMs' Feedback in Retrieval-Augmented Generation

Yuhang Liu, Xueyu Hu, Shengyu Zhang +3

cs.CV2023

ANetQA: A Large-scale Benchmark for Fine-grained Compositional Reasoning over Untrimmed Videos

Zhou Yu, Lixiang Zheng, Zhou Zhao +4

cs.CV2021

VersatileGait: A Large-Scale Synthetic Gait Dataset with Fine-GrainedAttributes and Complicated Scenarios

Huanzhang Dou, Wenhu Zhang, Pengyi Zhang +6

cs.AI2026

A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports

Jia Yu, Yan Zhu, Yili He +12

The paper presents EndoCLIP, a vision‑language foundation model for colonoscopy that learns from lesion‑level image‑text pairs extracted from routine colonoscopy reports, achieving…

#colonoscopy#vision-language models#report grounding#image-text retrieval
cs.CV2022

E2-AEN: End-to-End Incremental Learning with Adaptively Expandable Network

Guimei Cao, Zhanzhan Cheng, Yunlu Xu +4

cs.LG2024

MergeNet: Knowledge Migration across Heterogeneous Models, Tasks, and Modalities

Kunxi Li, Tianyu Zhan, Kairui Fu +6

cs.CL2025

ClaimGen-CN: A Large-scale Chinese Dataset for Legal Claim Generation

Siying Zhou, Yiquan Wu, Hui Chen +6

cs.CL2025

Evaluating Test-Time Scaling LLMs for Legal Reasoning: OpenAI o1, DeepSeek-R1, and Beyond

Yinghao Hu, Yaoyao Yu, Leilei Gan +3

cs.CV2023

SUES-200: A Multi-height Multi-scene Cross-view Image Benchmark Across Drone and Satellite

Runzhe Zhu, Ling Yin, Mingze Yang +3

cs.LG2024

Learning Individual Treatment Effects under Heterogeneous Interference in Networks

Ziyu Zhao, Yuqi Bai, Kun Kuang +2

cs.CV2026

Enhancing Diffusion-Based Quantitatively Controllable Image Generation via Matrix-Form EDM and Adaptive Vicinal Training

Xin Ding, Yun Chen, Sen Zhang +5

cs.HC2026

SAVVY: Student Attention Visualization for Video-based Learning Analysis

Shixian Zhou, Minghuan Shen, Xiaolin Wen +6

cs.CL2018

Cross-relation Cross-bag Attention for Distantly-supervised Relation Extraction

Yujin Yuan, Liyuan Liu, Siliang Tang +5

cs.CV2020

TextRay: Contour-based Geometric Modeling for Arbitrary-shaped Scene Text Detection

Fangfang Wang, Yifeng Chen, Fei Wu +1

cs.CL2025

CDLM: Causal Concept-Guided Diffusion Large Language Models

Kairong Han, Nuanqiao Shan, Ziyu Zhao +6

cs.CL2025

PsychBench: A comprehensive and professional benchmark for evaluating the performance of LLM-assisted psychiatric clinical practice

Shuyu Liu, Ruoxi Wang, Ling Zhang +7

cs.CV2021

SPIN: Structure-Preserving Inner Offset Network for Scene Text Recognition

Chengwei Zhang, Yunlu Xu, Zhanzhan Cheng +4

cs.CV2025

EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT

Baoqi Pei, Yifei Huang, Jilan Xu +5

cs.DC2025

FpgaHub: Fpga-centric Hyper-heterogeneous Computing Platform for Big Data Analytics

Zeke Wang, Jie Zhang, Hongjing Huang +10

cs.CV2025

Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning

Baoqi Pei, Yifei Huang, Jilan Xu +8

cs.LG2022

Walle: An End-to-End, General-Purpose, and Large-Scale Production System for Device-Cloud Collaborative Machine Learning

Chengfei Lv, Chaoyue Niu, Renjie Gu +17

stat.ME2021

Learning Decomposed Representation for Counterfactual Inference

Anpeng Wu, Kun Kuang, Junkun Yuan +5

cs.LG2025

MadaKV: Adaptive Modality-Perception KV Cache Eviction for Efficient Multimodal Long-Context Inference

Kunxi Li, Zhonghua Jiang, Zhouzhou Shen +5

cs.LG2021

KD3A: Unsupervised Multi-Source Decentralized Domain Adaptation via Knowledge Distillation

Hao-Zhe Feng, Zhaoyang You, Minghao Chen +5

cs.NI2017

Concurrent Channel Probing and Data Transmission in Full-duplex MIMO Systems

Zhenzhi Qian, Fei Wu, Zizhan Zheng +2