papers

Publications (65)

cs.CV2026

XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models

Xingrui Wang, Jiang Liu, Chao Huang +7

cs.LG2025

Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity

Yide Ran, Wentao Guo, Jingwei Sun +7

cs.RO2025

RFUAV: A Benchmark Dataset for Unmanned Aerial Vehicle Detection and Identification

Rui Shi, Xiaodong Yu, Shengming Wang +4

cs.CL2024

ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks

Xiaodong Yu, Hao Cheng, Xiaodong Liu +2

cs.CL2020

Design Challenges in Low-resource Cross-lingual Entity Linking

Xingyu Fu, Weijia Shi, Xiaodong Yu +2

cs.CV2021

SOIT: Segmenting Objects with Instance-Aware Transformers

Xiaodong Yu, Dahu Shi, Xing Wei +3

cs.AR2026

KV-RM: Regularizing KV-Cache Movement for Static-Graph LLM Serving

Zhiqing Zhong, Zhijing Ye, Jian Zhang +3

cs.CL2023

Building Interpretable and Reliable Open Information Retriever for New Domains Overnight

Xiaodong Yu, Ben Zhou, Dan Roth

cs.CL2026

Reliable Use of Lemmas via Eligibility Reasoning and SectionAware Reinforcement Learning

Zhikun Xu, Xiaodong Yu, Ben Zhou +6

cs.DC2023

GPULZ: Optimizing LZSS Lossless Compression for Multi-byte Data on Modern GPUs

Boyuan Zhang, Jiannan Tian, Sheng Di +4

cs.AR2024

GFormer: Accelerating Large Language Models with Optimized Transformers on Gaudi Processors

Chengming Zhang, Xinheng Ding, Baixi Sun +4

cs.CL2024

Lightweight Spatial Modeling for Combinatorial Information Extraction From Documents

Yanfei Dong, Lambert Deng, Jiazheng Zhang +5

cs.DC2021

Scalable and accurate multi-GPU based image reconstruction of large-scale ptychography data

Xiaodong Yu, Viktor Nikitin, Daniel J. Ching +3

cs.CV2025

Unleashing Hour-Scale Video Training for Long Video-Language Understanding

Jingyang Lin, Jialian Wu, Ximeng Sun +8

cs.CV2026

DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning

Chao Huang, Zeliang Zhang, Jiang Liu +7

cs.DC2021

Optimizing Error-Bounded Lossy Compression for Scientific Data on GPUs

Jiannan Tian, Sheng Di, Xiaodong Yu +7

cs.LG2025

MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?

Songkai Ma, Zhaorui Zhang, Sheng Di +4

cs.CV2025

MOVi: Training-free Text-conditioned Multi-Object Video Generation

Aimon Rahman, Jiang Liu, Ze Wang +7

cs.CL2025

Instella: Fully Open Language Models with Stellar Performance

Jiang Liu, Jialian Wu, Xiaodong Yu +10

cs.CV2025

Learning from Online Videos at Inference Time for Computer-Use Agents

Yujian Liu, Ze Wang, Hao Chen +7

cs.CL2022

Learning to Decompose: Hypothetical Question Decomposition Based on Comparable Texts

Ben Zhou, Kyle Richardson, Xiaodong Yu +1

cs.CL2026

TLRD: Teaching LLMs to Reason over Tabular Data with Tri-Level Rationale Distillation

Tianyuan Liang, Xuwei Tan, Lei Shi +6

cs.DC2025

A Survey on Error-Bounded Lossy Compression for Scientific Datasets

Sheng Di, Jinyang Liu, Kai Zhao +23

cs.LG2023

Benchmarking and In-depth Performance Study of Large Language Models on Habana Gaudi Processors

Chengming Zhang, Baixi Sun, Xiaodong Yu +5

cs.CL2026

ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training

Feijiang Han, Xiaodong Yu, Jianheng Tang +3

cs.DC2023

FZ-GPU: A Fast and High-Ratio Lossy Compressor for Scientific Computing Applications on GPUs

Boyuan Zhang, Jiannan Tian, Sheng Di +5

cs.DC2021

High-Performance Ptychographic Reconstruction with Federated Facilities

Tekin Bicer, Xiaodong Yu, Daniel J. Ching +5

cs.DC2024

An Optimized Error-controlled MPI Collective Framework Integrated with Lossy Compression

Jiajun Huang, Sheng Di, Xiaodong Yu +11

cs.AR2025

DABench-LLM: Standardized and In-Depth Benchmarking of Post-Moore Dataflow AI Accelerators for LLMs

Ziyu Hu, Zhiqing Zhong, Weijian Zheng +6

cs.DC2022

Optimizing Huffman Decoding for Error-Bounded Lossy Compression on GPUs

Cody Rivera, Sheng Di, Jiannan Tian +3

cs.CL2026

Stabilizing Efficient Reasoning with Step-Level Advantage Selection

Han Wang, Xiaodong Yu, Jialian Wu +4

cs.DC2024

gZCCL: Compression-Accelerated Collective Communication Framework for GPU Clusters

Jiajun Huang, Sheng Di, Xiaodong Yu +11

cs.CV2025

Instella-T2I: Pushing the Limits of 1D Discrete Latent Space Image Generation

Ze Wang, Hao Chen, Benran Hu +7

cs.CV2022

InsPose: Instance-Aware Networks for Single-Stage Multi-Person Pose Estimation

Dahu Shi, Xing Wei, Xiaodong Yu +3

cs.LG2025

An Efficient Gradient-Aware Error-Bounded Lossy Compressor for Federated Learning

Zhijing Ye, Sheng Di, Jiamin Wang +3

cs.AI2024

ReasonAgain: Using Extractable Symbolic Programs to Evaluate Mathematical Reasoning

Xiaodong Yu, Ben Zhou, Hao Cheng +1

cs.LG2025

APRIL: Active Partial Rollouts in Reinforcement Learning to Tame Long-tail Generation

Yuzhen Zhou, Jiajun Li, Yusheng Su +15

physics.app-ph2020

Combinatorial Laser Molecular Beam Epitaxy System Integrated with Specialized Low-temperature Scanning Tunneling Microscopy

Ge He, Zhongxu Wei, Zhongpei Feng +6

cs.LG2025

KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning

Zhendong Mi, Qitao Tan, Xiaodong Yu +3

cs.HC2025

Agent Laboratory: Using LLM Agents as Research Assistants

Samuel Schmidgall, Yusheng Su, Ze Wang +7

cs.SE2026

An Executable Benchmarking Suite for Tool-Using Agents

Zhiqing Zhong, Zhijing Ye, Jiamin Wang +1

cs.CL2023

Pairwise Representation Learning for Event Coreference

Xiaodong Yu, Wenpeng Yin, Dan Roth

cs.LG2024

Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity

Wentao Guo, Jikai Long, Yimeng Zeng +9

cs.CL2023

Event Linking: Grounding Event Mentions to Wikipedia

Xiaodong Yu, Wenpeng Yin, Nitish Gupta +1

cs.DC2026

NCCLZ: Compression-Enabled GPU Collectives with Decoupled Quantization and Entropy Coding

Jiamin Wang, Zhijing Ye, Xiaodong Yu

cs.LG2025

ALinFiK: Learning to Approximate Linearized Future Influence Kernel for Scalable Third-Party LLM Data Valuation

Yanzhou Pan, Huawei Lin, Yide Ran +5

cs.DC2022

SOLAR: A Highly Optimized Data Loading Framework for Distributed Training of CNN-based Scientific Surrogates

Baixi Sun, Xiaodong Yu, Chengming Zhang +7

cs.AI2025

Where LLM Agents Fail and How They can Learn From Failures

Kunlun Zhu, Zijia Liu, Bingxuan Li +15

cs.CL2026

Residual Skill Optimization for Text-to-SQL Ensembles

Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant +8

cond-mat.mtrl-sci2018

Structures and Physical Properties of CsVSeO and VSeO

Hai Lin, Jin Si, Xiyu Zhu +5

cs.CL2018

On the Strength of Character Language Models for Multilingual Named Entity Recognition

Xiaodong Yu, Stephen Mayhew, Mark Sammons +1

cs.CV2025

KeyVID: Keyframe-Aware Video Diffusion for Audio-Synchronized Visual Animation

Xingrui Wang, Jiang Liu, Ze Wang +7

cs.DC2023

HEAT: A Highly Efficient and Affordable Training System for Collaborative Filtering Based Recommendation on CPUs

Chengming Zhang, Shaden Smith, Baixi Sun +6

cs.CV2025

Latent Visual Reasoning

Bangzheng Li, Ximeng Sun, Jiang Liu +7

cs.CV2025

ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning

Yuxiang Guo, Jiang Liu, Ze Wang +7

cs.CL2024

Model Tells Itself Where to Attend: Faithfulness Meets Automatic Attention Steering

Qingru Zhang, Xiaodong Yu, Chandan Singh +6

cs.LG2025

Interpretable Deep Learning Paradigm for Airborne Transient Electromagnetic Inversion

Shuang Wang, Xuben Wang, Fei Deng +3

cs.DC2025

ZCCL: Significantly Improving Collective Communication With Error-Bounded Lossy Compression

Jiajun Huang, Sheng Di, Xiaodong Yu +12

cs.CL2025

Self-Taught Agentic Long Context Understanding

Yufan Zhuang, Xiaodong Yu, Jialian Wu +7

cs.DC2022

SZx: an Ultra-fast Error-bounded Lossy Compressor for Scientific Datasets

Xiaodong Yu, Sheng Di, Kai Zhao +4

cs.LG2026

Effective MoE-based LLM Compression by Exploiting Heterogeneous Inter-Group Experts Routing Frequency and Information Density

Zhendong Mi, Yixiao Chen, Pu Zhao +4

cs.LG2025

OAT-Rephrase: Optimization-Aware Training Data Rephrasing for Zeroth-Order LLM Fine-Tuning

Jikai Long, Zijian Hu, Xiaodong Yu +2

cs.CL2026

CD4LM: Consistency Distillation and aDaptive Decoding for Diffusion Language Models

Yihao Liang, Ze Wang, Hao Chen +7

cs.CL2025

TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games

Prakamya Mishra, Jiang Liu, Jialian Wu +3

cs.CV2026

VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking

Jingyang Lin, Jialian Wu, Jiang Liu +6