Publications (55)
Constraints-Guided Diffusion Reasoner for Neuro-Symbolic Learning
Xuan Zhang, Zhijian Zhou, Weidi Xu +3
Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
Luozheng Qin, Jia Gong, Qian Qiao +6
LogicMP: A Neuro-symbolic Approach for Encoding First-order Logic Constraints
Weidi Xu, Jingwei Wang, Lele Xie +7
Linear Convergence of SVRG in Statistical Estimation
Chao Qu, Yan Li, Huan Xu
Bayesian Deep Basis Fitting for Depth Completion with Uncertainty
Chao Qu, Wenxin Liu, Camillo J. Taylor
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
Haozhe Wang, Chao Qu, Zuming Huang +3
Nonlinear Distributional Gradient Temporal-Difference Learning
Chao Qu, Shie Mannor, Huan Xu
Large-scale Autonomous Flight with Real-time Semantic SLAM under Dense Forest Canopy
Xu Liu, Guilherme V. Nardari, Fernando Cladera Ojeda +8
Equivariant Masked Position Prediction for Efficient Molecular Representation
Junyi An, Chao Qu, Yun-Fei Shi +4
AURORA:Automated Training Framework of Universal Process Reward Models via Ensemble Prompting and Reverse Verification
Xiaoyu Tan, Tianchu Yao, Chao Qu +8
Unleashing Flow Policies with Distributional Critics
Deshu Chen, Yuchen Liu, Zhijian Zhou +2
Guiding Diffusion Models with Reinforcement Learning for Stable Molecule Generation
Zhijian Zhou, Junyi An, Zongkai Liu +5
Adaptive Learning on User Segmentation: Universal to Specific Representation via Bipartite Neural Interaction
Xiaoyu Tan, Yongxin Deng, Chao Qu +4
SLOAM: Semantic Lidar Odometry and Mapping for Forest Inventory
Steven W. Chen, Guilherme V. Nardari, Elijah S. Lee +4
SAGA and Restricted Strong Convexity
Chao Qu, Yan Li, Huan Xu
Equivariant Asynchronous Diffusion: An Adaptive Denoising Schedule for Accelerated Molecular Conformation Generation
Junyi An, Chao Qu, Yun-Fei Shi +3
LLOL: Low-Latency Odometry for Spinning Lidars
Chao Qu, Shreyas S. Shivakumar, Wenxin Liu +1
Variational Policy Propagation for Multi-agent Reinforcement Learning
Chao Qu, Hui Li, Chang Liu +6
Bellman Meets Hawkes: Model-Based Reinforcement Learning via Temporal Point Processes
Chao Qu, Xiaoyu Tan, Siqiao Xue +3
To Code or not to Code? Adaptive Tool Integration for Math Language Models via Expectation-Maximization
Haozhe Wang, Long Li, Chao Qu +4
DyJR: Preserving Diversity in Reinforcement Learning with Verifiable Rewards via Dynamic Jensen-Shannon Replay
Long Li, Zhijian Zhou, Tianyi Wang +7
Depth Completion via Deep Basis Fitting
Chao Qu, Ty Nguyen, Camillo J. Taylor
Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning
Xuan Zhang, Zhijian Zhou, Lingfeng Qiao +6
The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward
Long Li, Zhijian Zhou, Jiaran Hao +9
Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities
Jiayi Kuang, Haojing Huang, Yinghui Li +8
Non-convex Conditional Gradient Sliding
Chao Qu, Yan Li, Huan Xu
PET-F2I: A Comprehensive Benchmark and Parameter-Efficient Fine-Tuning of LLMs for PET/CT Report Impression Generation
Yuchen Liu, Wenbo Zhang, Liling Peng +6
Near-infrared Image Deblurring and Event Denoising with Synergistic Neuromorphic Imaging
Chao Qu, Shuo Zhu, Yuhang Wang +4
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control
Haoyu Wang, Xiaoyu Tan, Xihe Qiu +1
Start Classifying: Categorical Critics for LLM Reinforcement Learning
Zhijian Zhou, Long Li, Xuan Zhang +7
Fast, Autonomous Flight in GPS-Denied and Cluttered Environments
Kartik Mohta, Michael Watterson, Yash Mulgaonkar +14
One Example Shown, Many Concepts Known! Counterexample-Driven Conceptual Reasoning in Mathematical LLMs
Yinghui Li, Jiayi Kuang, Haojing Huang +10
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
Yinghui Li, Haojing Huang, Jiayi Kuang +7
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
Xiaoyu Tan, Yongxin Deng, Xihe Qiu +5
Linear convergence of SDCA in statistical estimation
Chao Qu, Huan Xu
A Meta Reinforcement Learning Approach for Predictive Autoscaling in the Cloud
Siqiao Xue, Chao Qu, Xiaoming Shi +11
Equivariant Spherical Transformer for Efficient Molecular Modeling
Junyi An, Xinyu Lu, Chao Qu +6
Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision
Luozheng Qin, Jia Gong, Yuqing Sun +6
Towards Collaborative Intelligence: Propagating Intentions and Reasoning for Multi-Agent Coordination with Large Language Models
Xihe Qiu, Haoyu Wang, Xiaoyu Tan +6
Model Embedding Model-Based Reinforcement Learning
Xiaoyu Tan, Chao Qu, Junwu Xiong +1
Projection-Free Algorithms in Statistical Estimation
Yan Li, Chao Qu, Huan Xu
Count Counts: Motivating Exploration in LLM Reasoning with Count-based Intrinsic Rewards
Xuan Zhang, Ruixiao Li, Zhijian Zhou +7
PILLOW: Enhancing Efficient Instruction Fine-tuning via Prompt Matching
Zhenting Qi, Xiaoyu Tan, Shaojie Shi +3
Dynamic Facial Expression of Emotion Made Easy
Joost Broekens, Chao Qu, Willem-Paul Brinkman
SQL-ASTRA: Alleviating Sparse Feedback in Agentic SQL via Column-Set Matching and Trajectory Aggregation
Long Li, Zhijian Zhou, Jiangxuan Long +5
Robust Fruit Counting: Combining Deep Learning, Tracking, and Structure from Motion
Xu Liu, Steven W. Chen, Shreyas Aditya +6
Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning
Chao Qu, Shie Mannor, Huan Xu +3
Suiren-1.0 Technical Report: A Family of Molecular Foundation Models
Junyi An, Xinyu Lu, Yun-Fei Shi +5
CogniDual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks
Yongxin Deng, Xihe Qiu, Xiaoyu Tan +5
Fast Global Convergence via Landscape of Empirical Loss
Chao Qu, Yan Li, Huan Xu
An Open Quantum Chemistry Property Database of 120 Kilo Molecules with 20 Million Conformers
Weiqi Liu, Xi Ai, Zhijian Zhou +7
SCP-116K: A High-Quality Problem-Solution Dataset and a Generalized Pipeline for Automated Extraction in the Higher Education Science Domain
Dakuan Lu, Xiaoyu Tan, Rui Xu +5
DSOL: A Fast Direct Sparse Odometry Scheme
Chao Qu, Shreyas S. Shivakumar, Ian D. Miller +1
Communication-Efficient Projection-Free Algorithm for Distributed Optimization
Yan Li, Chao Qu, Huan Xu
Nested Spatio-Temporal Time Series Forecasting
Yinghao Ai, Yukai Zhou, Ruoxi Jiang +8