Publications (65)
XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models
Xingrui Wang, Jiang Liu, Chao Huang +7
Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity
Yide Ran, Wentao Guo, Jingwei Sun +7
RFUAV: A Benchmark Dataset for Unmanned Aerial Vehicle Detection and Identification
Rui Shi, Xiaodong Yu, Shengming Wang +4
ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks
Xiaodong Yu, Hao Cheng, Xiaodong Liu +2
Design Challenges in Low-resource Cross-lingual Entity Linking
Xingyu Fu, Weijia Shi, Xiaodong Yu +2
SOIT: Segmenting Objects with Instance-Aware Transformers
Xiaodong Yu, Dahu Shi, Xing Wei +3
KV-RM: Regularizing KV-Cache Movement for Static-Graph LLM Serving
Zhiqing Zhong, Zhijing Ye, Jian Zhang +3
Building Interpretable and Reliable Open Information Retriever for New Domains Overnight
Xiaodong Yu, Ben Zhou, Dan Roth
Reliable Use of Lemmas via Eligibility Reasoning and SectionAware Reinforcement Learning
Zhikun Xu, Xiaodong Yu, Ben Zhou +6
GPULZ: Optimizing LZSS Lossless Compression for Multi-byte Data on Modern GPUs
Boyuan Zhang, Jiannan Tian, Sheng Di +4
GFormer: Accelerating Large Language Models with Optimized Transformers on Gaudi Processors
Chengming Zhang, Xinheng Ding, Baixi Sun +4
Lightweight Spatial Modeling for Combinatorial Information Extraction From Documents
Yanfei Dong, Lambert Deng, Jiazheng Zhang +5
Scalable and accurate multi-GPU based image reconstruction of large-scale ptychography data
Xiaodong Yu, Viktor Nikitin, Daniel J. Ching +3
Unleashing Hour-Scale Video Training for Long Video-Language Understanding
Jingyang Lin, Jialian Wu, Ximeng Sun +8
DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning
Chao Huang, Zeliang Zhang, Jiang Liu +7
Optimizing Error-Bounded Lossy Compression for Scientific Data on GPUs
Jiannan Tian, Sheng Di, Xiaodong Yu +7
MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?
Songkai Ma, Zhaorui Zhang, Sheng Di +4
MOVi: Training-free Text-conditioned Multi-Object Video Generation
Aimon Rahman, Jiang Liu, Ze Wang +7
Instella: Fully Open Language Models with Stellar Performance
Jiang Liu, Jialian Wu, Xiaodong Yu +10
Learning from Online Videos at Inference Time for Computer-Use Agents
Yujian Liu, Ze Wang, Hao Chen +7
Learning to Decompose: Hypothetical Question Decomposition Based on Comparable Texts
Ben Zhou, Kyle Richardson, Xiaodong Yu +1
TLRD: Teaching LLMs to Reason over Tabular Data with Tri-Level Rationale Distillation
Tianyuan Liang, Xuwei Tan, Lei Shi +6
A Survey on Error-Bounded Lossy Compression for Scientific Datasets
Sheng Di, Jinyang Liu, Kai Zhao +23
Benchmarking and In-depth Performance Study of Large Language Models on Habana Gaudi Processors
Chengming Zhang, Baixi Sun, Xiaodong Yu +5
ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training
Feijiang Han, Xiaodong Yu, Jianheng Tang +3
FZ-GPU: A Fast and High-Ratio Lossy Compressor for Scientific Computing Applications on GPUs
Boyuan Zhang, Jiannan Tian, Sheng Di +5
High-Performance Ptychographic Reconstruction with Federated Facilities
Tekin Bicer, Xiaodong Yu, Daniel J. Ching +5
An Optimized Error-controlled MPI Collective Framework Integrated with Lossy Compression
Jiajun Huang, Sheng Di, Xiaodong Yu +11
DABench-LLM: Standardized and In-Depth Benchmarking of Post-Moore Dataflow AI Accelerators for LLMs
Ziyu Hu, Zhiqing Zhong, Weijian Zheng +6
Optimizing Huffman Decoding for Error-Bounded Lossy Compression on GPUs
Cody Rivera, Sheng Di, Jiannan Tian +3
Stabilizing Efficient Reasoning with Step-Level Advantage Selection
Han Wang, Xiaodong Yu, Jialian Wu +4
gZCCL: Compression-Accelerated Collective Communication Framework for GPU Clusters
Jiajun Huang, Sheng Di, Xiaodong Yu +11
Instella-T2I: Pushing the Limits of 1D Discrete Latent Space Image Generation
Ze Wang, Hao Chen, Benran Hu +7
InsPose: Instance-Aware Networks for Single-Stage Multi-Person Pose Estimation
Dahu Shi, Xing Wei, Xiaodong Yu +3
An Efficient Gradient-Aware Error-Bounded Lossy Compressor for Federated Learning
Zhijing Ye, Sheng Di, Jiamin Wang +3
ReasonAgain: Using Extractable Symbolic Programs to Evaluate Mathematical Reasoning
Xiaodong Yu, Ben Zhou, Hao Cheng +1
APRIL: Active Partial Rollouts in Reinforcement Learning to Tame Long-tail Generation
Yuzhen Zhou, Jiajun Li, Yusheng Su +15
Combinatorial Laser Molecular Beam Epitaxy System Integrated with Specialized Low-temperature Scanning Tunneling Microscopy
Ge He, Zhongxu Wei, Zhongpei Feng +6
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
Zhendong Mi, Qitao Tan, Xiaodong Yu +3
Agent Laboratory: Using LLM Agents as Research Assistants
Samuel Schmidgall, Yusheng Su, Ze Wang +7
An Executable Benchmarking Suite for Tool-Using Agents
Zhiqing Zhong, Zhijing Ye, Jiamin Wang +1
Pairwise Representation Learning for Event Coreference
Xiaodong Yu, Wenpeng Yin, Dan Roth
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
Wentao Guo, Jikai Long, Yimeng Zeng +9
Event Linking: Grounding Event Mentions to Wikipedia
Xiaodong Yu, Wenpeng Yin, Nitish Gupta +1
NCCLZ: Compression-Enabled GPU Collectives with Decoupled Quantization and Entropy Coding
Jiamin Wang, Zhijing Ye, Xiaodong Yu
ALinFiK: Learning to Approximate Linearized Future Influence Kernel for Scalable Third-Party LLM Data Valuation
Yanzhou Pan, Huawei Lin, Yide Ran +5
SOLAR: A Highly Optimized Data Loading Framework for Distributed Training of CNN-based Scientific Surrogates
Baixi Sun, Xiaodong Yu, Chengming Zhang +7
Where LLM Agents Fail and How They can Learn From Failures
Kunlun Zhu, Zijia Liu, Bingxuan Li +15
Residual Skill Optimization for Text-to-SQL Ensembles
Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant +8
Structures and Physical Properties of CsVSeO and VSeO
Hai Lin, Jin Si, Xiyu Zhu +5
On the Strength of Character Language Models for Multilingual Named Entity Recognition
Xiaodong Yu, Stephen Mayhew, Mark Sammons +1
KeyVID: Keyframe-Aware Video Diffusion for Audio-Synchronized Visual Animation
Xingrui Wang, Jiang Liu, Ze Wang +7
HEAT: A Highly Efficient and Affordable Training System for Collaborative Filtering Based Recommendation on CPUs
Chengming Zhang, Shaden Smith, Baixi Sun +6
Latent Visual Reasoning
Bangzheng Li, Ximeng Sun, Jiang Liu +7
ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning
Yuxiang Guo, Jiang Liu, Ze Wang +7
Model Tells Itself Where to Attend: Faithfulness Meets Automatic Attention Steering
Qingru Zhang, Xiaodong Yu, Chandan Singh +6
Interpretable Deep Learning Paradigm for Airborne Transient Electromagnetic Inversion
Shuang Wang, Xuben Wang, Fei Deng +3
ZCCL: Significantly Improving Collective Communication With Error-Bounded Lossy Compression
Jiajun Huang, Sheng Di, Xiaodong Yu +12
Self-Taught Agentic Long Context Understanding
Yufan Zhuang, Xiaodong Yu, Jialian Wu +7
SZx: an Ultra-fast Error-bounded Lossy Compressor for Scientific Datasets
Xiaodong Yu, Sheng Di, Kai Zhao +4
Effective MoE-based LLM Compression by Exploiting Heterogeneous Inter-Group Experts Routing Frequency and Information Density
Zhendong Mi, Yixiao Chen, Pu Zhao +4
OAT-Rephrase: Optimization-Aware Training Data Rephrasing for Zeroth-Order LLM Fine-Tuning
Jikai Long, Zijian Hu, Xiaodong Yu +2
CD4LM: Consistency Distillation and aDaptive Decoding for Diffusion Language Models
Yihao Liang, Ze Wang, Hao Chen +7
TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games
Prakamya Mishra, Jiang Liu, Jialian Wu +3
VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking
Jingyang Lin, Jialian Wu, Jiang Liu +6