papers

Publications (55)

cs.AI2025

Constraints-Guided Diffusion Reasoner for Neuro-Symbolic Learning

Xuan Zhang, Zhijian Zhou, Weidi Xu +3

cs.CV2026

Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator

Luozheng Qin, Jia Gong, Qian Qiao +6

cs.AI2025

LogicMP: A Neuro-symbolic Approach for Encoding First-order Logic Constraints

Weidi Xu, Jingwei Wang, Lele Xie +7

stat.ML2017

Linear Convergence of SVRG in Statistical Estimation

Chao Qu, Yan Li, Huan Xu

cs.CV2021

Bayesian Deep Basis Fitting for Depth Completion with Uncertainty

Chao Qu, Wenxin Liu, Camillo J. Taylor

cs.LG2025

VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning

Haozhe Wang, Chao Qu, Zuming Huang +3

cs.LG2019

Nonlinear Distributional Gradient Temporal-Difference Learning

Chao Qu, Shie Mannor, Huan Xu

cs.RO2023

Large-scale Autonomous Flight with Real-time Semantic SLAM under Dense Forest Canopy

Xu Liu, Guilherme V. Nardari, Fernando Cladera Ojeda +8

cs.LG2025

Equivariant Masked Position Prediction for Efficient Molecular Representation

Junyi An, Chao Qu, Yun-Fei Shi +4

cs.CL2025

AURORA:Automated Training Framework of Universal Process Reward Models via Ensemble Prompting and Reverse Verification

Xiaoyu Tan, Tianchu Yao, Chao Qu +8

cs.LG2025

Unleashing Flow Policies with Distributional Critics

Deshu Chen, Yuchen Liu, Zhijian Zhou +2

cs.LG2025

Guiding Diffusion Models with Reinforcement Learning for Stable Molecule Generation

Zhijian Zhou, Junyi An, Zongkai Liu +5

cs.LG2024

Adaptive Learning on User Segmentation: Universal to Specific Representation via Bipartite Neural Interaction

Xiaoyu Tan, Yongxin Deng, Chao Qu +4

cs.RO2019

SLOAM: Semantic Lidar Odometry and Mapping for Forest Inventory

Steven W. Chen, Guilherme V. Nardari, Elijah S. Lee +4

stat.ML2017

SAGA and Restricted Strong Convexity

Chao Qu, Yan Li, Huan Xu

cs.LG2026

Equivariant Asynchronous Diffusion: An Adaptive Denoising Schedule for Accelerated Molecular Conformation Generation

Junyi An, Chao Qu, Yun-Fei Shi +3

cs.RO2022

LLOL: Low-Latency Odometry for Spinning Lidars

Chao Qu, Shreyas S. Shivakumar, Wenxin Liu +1

cs.LG2022

Variational Policy Propagation for Multi-agent Reinforcement Learning

Chao Qu, Hui Li, Chang Liu +6

cs.LG2022

Bellman Meets Hawkes: Model-Based Reinforcement Learning via Temporal Point Processes

Chao Qu, Xiaoyu Tan, Siqiao Xue +3

cs.AI2025

To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization

Haozhe Wang, Long Li, Chao Qu +4

cs.LG2026

DyJR: Preserving Diversity in Reinforcement Learning with Verifiable Rewards via Dynamic Jensen-Shannon Replay

Long Li, Zhijian Zhou, Tianyi Wang +7

cs.CV2019

Depth Completion via Deep Basis Fitting

Chao Qu, Ty Nguyen, Camillo J. Taylor

cs.AI2026

Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning

Xuan Zhang, Zhijian Zhou, Lingfeng Qiao +6

cs.LG2026

The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward

Long Li, Zhijian Zhou, Jiaran Hao +9

cs.CL2025

Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities

Jiayi Kuang, Haojing Huang, Yinghui Li +8

math.OC2017

Non-convex Conditional Gradient Sliding

Chao Qu, Yan Li, Huan Xu

cs.CV2026

PET-F2I: A Comprehensive Benchmark and Parameter-Efficient Fine-Tuning of LLMs for PET/CT Report Impression Generation

Yuchen Liu, Wenbo Zhang, Liling Peng +6

cs.CV2025

Near-infrared Image Deblurring and Event Denoising with Synergistic Neuromorphic Imaging

Chao Qu, Shuo Zhu, Yuhang Wang +4

cs.RO2024

Subequivariant Reinforcement Learning Framework for Coordinated Motion Control

Haoyu Wang, Xiaoyu Tan, Xihe Qiu +1

cs.LG2026

Start Classifying: Categorical Critics for LLM Reinforcement Learning

Zhijian Zhou, Long Li, Xuan Zhang +7

cs.RO2017

Fast, Autonomous Flight in GPS-Denied and Cluttered Environments

Kartik Mohta, Michael Watterson, Yash Mulgaonkar +14

cs.LG2025

One Example Shown, Many Concepts Known! Counterexample-Driven Conceptual Reasoning in Mathematical LLMs

Yinghui Li, Jiayi Kuang, Haojing Huang +10

cs.CL2025

Refine Knowledge of Large Language Models via Adaptive Contrastive Learning

Yinghui Li, Haojing Huang, Jiayi Kuang +7

cs.AI2024

Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought

Xiaoyu Tan, Yongxin Deng, Xihe Qiu +5

stat.ML2017

Linear convergence of SDCA in statistical estimation

Chao Qu, Huan Xu

cs.LG2022

A Meta Reinforcement Learning Approach for Predictive Autoscaling in the Cloud

Siqiao Xue, Chao Qu, Xiaoming Shi +11

cs.LG2025

Equivariant Spherical Transformer for Efficient Molecular Modeling

Junyi An, Xinyu Lu, Chao Qu +6

cs.CV2026

Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision

Luozheng Qin, Jia Gong, Yuqing Sun +6

cs.CL2024

Towards Collaborative Intelligence: Propagating Intentions and Reasoning for Multi-Agent Coordination with Large Language Models

Xihe Qiu, Haoyu Wang, Xiaoyu Tan +6

cs.LG2020

Model Embedding Model-Based Reinforcement Learning

Xiaoyu Tan, Chao Qu, Junwu Xiong +1

stat.ML2018

Projection-Free Algorithms in Statistical Estimation

Yan Li, Chao Qu, Huan Xu

cs.AI2025

Count Counts: Motivating Exploration in LLM Reasoning with Count-based Intrinsic Rewards

Xuan Zhang, Ruixiao Li, Zhijian Zhou +7

cs.CL2024

PILLOW: Enhancing Efficient Instruction Fine-tuning via Prompt Matching

Zhenting Qi, Xiaoyu Tan, Shaojie Shi +3

cs.HC2012

Dynamic Facial Expression of Emotion Made Easy

Joost Broekens, Chao Qu, Willem-Paul Brinkman

cs.AI2026

SQL-ASTRA: Alleviating Sparse Feedback in Agentic SQL via Column-Set Matching and Trajectory Aggregation

Long Li, Zhijian Zhou, Jiangxuan Long +5

cs.CV2018

Robust Fruit Counting: Combining Deep Learning, Tracking, and Structure from Motion

Xu Liu, Steven W. Chen, Shreyas Aditya +6

cs.LG2019

Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning

Chao Qu, Shie Mannor, Huan Xu +3

physics.chem-ph2026

Suiren-1.0 Technical Report: A Family of Molecular Foundation Models

Junyi An, Xinyu Lu, Yun-Fei Shi +5

cs.CL2024

CogniDual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks

Yongxin Deng, Xihe Qiu, Xiaoyu Tan +5

stat.ML2018

Fast Global Convergence via Landscape of Empirical Loss

Chao Qu, Yan Li, Huan Xu

physics.chem-ph2024

An Open Quantum Chemistry Property Database of 120 Kilo Molecules with 20 Million Conformers

Weiqi Liu, Xi Ai, Zhijian Zhou +7

cs.CL2025

SCP-116K: A High-Quality Problem-Solution Dataset and a Generalized Pipeline for Automated Extraction in the Higher Education Science Domain

Dakuan Lu, Xiaoyu Tan, Rui Xu +5

cs.RO2022

DSOL: A Fast Direct Sparse Odometry Scheme

Chao Qu, Shreyas S. Shivakumar, Ian D. Miller +1

math.OC2018

Communication-Efficient Projection-Free Algorithm for Distributed Optimization

Yan Li, Chao Qu, Huan Xu

cs.LG2026

Nested Spatio-Temporal Time Series Forecasting

Yinghao Ai, Yukai Zhou, Ruoxi Jiang +8