Publications (158)
ChatBEV: A Visual Language Model that Understands BEV Maps
Qingyao Xu, Siheng Chen, Guang Chen +2
AdamMeme: Adaptively Probe the Reasoning Capacity of Multimodal Large Language Models on Harmfulness
Zixin Chen, Hongzhan Lin, Kaixin Li +5
PAN: Towards Fast Action Recognition via Learning Persistence of Appearance
Can Zhang, Yuexian Zou, Guang Chen +1
Embracing Events and Frames with Hierarchical Feature Refinement Network for Object Detection
Hu Cao, Zehua Zhang, Yan Xia +4
VEBench:Benchmarking Large Multimodal Models for Real-World Video Editing
Andong Deng, Dawei Du, Zhenfang Chen +7
NAST: Non-Autoregressive Spatial-Temporal Transformer for Time Series Forecasting
Kai Chen, Guang Chen, Dan Xu +3
Geography and distance effect on financial dynamics in the Chinese stock market
Xing Li, Tian Qiu, Guang Chen +2
MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning
Haoyu Fu, Diankun Zhang, Zongchuang Zhao +7
The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs
Xu Wan, Speed Zhu, Jianwei Cai +4
RSKDD-Net: Random Sample-based Keypoint Detector and Descriptor
Fan Lu, Guang Chen, Yinlong Liu +2
Urban Radiance Field Representation with Deformable Neural Mesh Primitives
Fan Lu, Yan Xu, Guang Chen +3
Investigating Students' Preferences for AI Roles in Mathematical Modelling: Evidence from a Randomized Controlled Trial
Wangda Zhu, Guang Chen, Yumeng Zhu +2
PointINet: Point Cloud Frame Interpolation Network
Fan Lu, Guang Chen, Sanqing Qu +3
Detect Rumors in Microblog Posts for Low-Resource Domains via Adversarial Contrastive Learning
Hongzhan Lin, Jing Ma, Liangliang Chen +3
CausalDrive: Real-time Causal World Models for Autonomous Driving
Tianyi Yan, Huan Zheng, Dubing Chen +10
MoNet: Motion-based Point Cloud Prediction Network
Fan Lu, Guang Chen, Yinlong Liu +3
Heterogeneity Involved Network-based Algorithm Leads to Accurate and Personalized Recommendations
Tian Qiu, Tian-Tian Wang, Zi-Ke Zhang +2
GeoNLF: Geometry guided Pose-Free Neural LiDAR Fields
Weiyi Xue, Zehan Zheng, Fan Lu +3
HDMNet: A Hierarchical Matching Network with Double Attention for Large-scale Outdoor LiDAR Point Cloud Registration
Weiyi Xue, Fan Lu, Guang Chen
Pensieve: Retrospect-then-Compare Mitigates Visual Hallucination
Dingchen Yang, Bowen Cao, Guang Chen +1
BMD: A General Class-balanced Multicentric Dynamic Prototype Strategy for Source-free Domain Adaptation
Sanqing Qu, Guang Chen, Jing Zhang +3
DMInet: An Accurate and Highly Flexible Deep Learning Framework for Drug Membrane Interaction with Membrane Selectivity
Guang Chen
PerlAD: Towards Enhanced Closed-loop End-to-end Autonomous Driving with Pseudo-simulation-based Reinforcement Learning
Yinfeng Gao, Qichao Zhang, Deqing Liu +8
Hierarchical Latent Semantic Mapping for Automated Topic Generation
Guorui Zhou, Guang Chen
Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
Jinghui Lu, Jiayi Guan, Zhijian Huang +47
AutoMine Solution for AV2 2026 Scenario Mining Challenge
Songliang Cao, Jiele Zhao, Yuru Wang +10
DriveMRP: Enhancing Vision-Language Models with Synthetic Motion Data for Motion Risk Prediction
Zhiyi Hou, Enhui Ma, Fang Li +11
AgentThink: A Unified Framework for Tool-Augmented Chain-of-Thought Reasoning in Vision-Language Models for Autonomous Driving
Kangan Qian, Sicong Jiang, Yang Zhong +18
Pixel-Perfect Visual Geometry Estimation
Gangwei Xu, Haotong Lin, Hongcheng Luo +6
ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving
Yongkang Li, Kaixin Xiong, Xiangyu Guo +12
Neuromorphic Visual Odometry System for Intelligent Vehicle Application with Bio-inspired Vision Sensor
Dekai Zhu, Jinhu Dong, Zhongcong Xu +5
Genesis: Multimodal Driving Scene Generation with Spatio-Temporal and Cross-Modal Consistency
Xiangyu Guo, Zhanqian Wu, Kaixin Xiong +10
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
Yixuan Zhang, Qing Chang, Yuxi Wang +3
PIT: A Dynamic Personalized Item Tokenizer for End-to-End Generative Recommendation
Huanjie Wang, Xinchen Luo, Honghui Bao +6
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
Shengkang Wang, Hongzhan Lin, Ziyang Luo +3
Rumor Detection on Twitter with Claim-Guided Hierarchical Graph Attention Networks
Hongzhan Lin, Jing Ma, Mingfei Cheng +3
MU-GeNeRF: Multi-view Uncertainty-guided Generalizable Neural Radiance Fields for Distractor-aware Scene
Wenjie Mu, Zhan Li, Chuanzhou Su +8
MeanFuser: Fast One-Step Multi-Modal Trajectory Generation and Adaptive Reconstruction via MeanFlow for End-to-End Autonomous Driving
Junli Wang, Yinan Zheng, Xueyi Liu +9
Rethinking Driving World Model as Synthetic Data Generator for Perception Tasks
Kai Zeng, Zhanqian Wu, Kaixin Xiong +12
Unsupervised Domain Adaptation for Nighttime Aerial Tracking
Junjie Ye, Changhong Fu, Guangze Zheng +2
A Review of Safe Reinforcement Learning: Methods, Theory and Applications
Shangding Gu, Long Yang, Yali Du +4
ATHENA: Accelerated Multi-Task Heterogeneous Influence Functions for Robot Data Curation
Tao Xu, Jiaxin Wang, Runhao Zhang +7
DriveVA: Video Action Models are Zero-Shot Drivers
Mengmeng Liu, Diankun Zhang, Jiuming Liu +7
Risk Assessment for Nonlinear Cyber-Physical Systems under Stealth Attacks
Guang Chen, Zhicong Sun, Yulong Ding +1
Pixel-Perfect Depth with Semantics-Prompted Diffusion Transformers
Gangwei Xu, Haotong Lin, Hongcheng Luo +11
MAP: MAsk-Pruning for Source-Free Model Intellectual Property Protection
Boyang Peng, Sanqing Qu, Yong Wu +5
Text with Knowledge Graph Augmented Transformer for Video Captioning
Xin Gu, Guang Chen, Yufei Wang +3
Scaling and Memory Effect in Volatility Return Interval of the Chinese Stock Market
Tian Qiu, Liang Guo, Guang Chen
DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation
Sunyao Zhou, Yunzi Wu, Tianhang Wang +5
LVDrive: Latent Visual Representation Enhanced Vision-Language-Action Autonomous Driving Model
Xiaodong Mei, Diankun Zhang, Hongwei Xie +3
Generative Multi-Agent Collaboration in Embodied AI: A Systematic Review
Di Wu, Xian Wei, Guang Chen +4
UNIVERSE: Unified Video Action Models for Autonomous Driving with Flexible Mask-Modulated Modality Generation
Mengmeng Liu, Diankun Zhang, Jiuming Liu +7
OVC-Net: Object-Oriented Video Captioning with Temporal Graph and Detail Enhancement
Fangyi Zhu, Jenq-Neng Hwang, Zhanyu Ma +2
The Inevitability of Side-Channel Leakage in Encrypted Traffic
Guangjie Liu, Guang Chen, Weiwei Liu
ASTRO: Adaptive Stitching via Dynamics-Guided Trajectory Rollouts
Hang Yu, Di Zhang, Qiwei Du +5
KAT-V1: Kwai-AutoThink Technical Report
Zizheng Zhan, Ken Deng, Huaixi Tang +27
CofiPara: A Coarse-to-fine Paradigm for Multimodal Sarcasm Target Identification with Large Multimodal Models
Hongzhan Lin, Zixin Chen, Ziyang Luo +3
Vidi: Large Multimodal Models for Video Understanding and Editing
Vidi Team, Celong Liu, Chia-Wen Kuo +20
Linear stability and spectral modal decomposition of three-dimensional turbulent wake flow of a generic high-speed train
Xiao-Bai Li, Simon Demange, Guang Chen +4
Towards Intelligible Human-Robot Interaction: An Active Inference Approach to Occluded Pedestrian Scenarios
Kai Chen, Yuyao Huang, Guang Chen
TMA: Temporal Motion Aggregation for Event-based Optical Flow
Haotian Liu, Guang Chen, Sanqing Qu +4
Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning
Ziyang Yao, Haochen Liu, Yuncheng Jiang +10
Dichotomous Diffusion Policy Optimization
Ruiming Liang, Yinan Zheng, Kexin Zheng +9
HRegNet: A Hierarchical Network for Large-scale Outdoor LiDAR Point Cloud Registration
Fan Lu, Guang Chen, Yinlong Liu +4
Efficient Pig Counting in Crowds with Keypoints Tracking and Spatial-aware Temporal Response Filtering
Guang Chen, Shiwen Shen, Longyin Wen +2
Beyond Imitation: Learning Safe End-to-End Autonomous Driving from Hard Negatives
Junli Wang, Zhihua Hua, Xueyi Liu +7
LAP-Net: Adaptive Features Sampling via Learning Action Progression for Online Action Detection
Sanqing Qu, Guang Chen, Dan Xu +3
An Efficient L-Shape Fitting Method for Vehicle Pose Detection with 2D LiDAR
Sanqing Qu, Guang Chen, Canbo Ye +4
Dynamics of Bid-ask Spread Return and Volatility of the Chinese Stock Market
Tian Qiu, Guang Chen, Li-Xin Zhong +1
ExtraGS: Geometric-Aware Trajectory Extrapolation with Uncertainty-Guided Generative Priors
Kaiyuan Tan, Yingying Shen, Haohui Zhu +8
Signal Structure-Aware Gaussian Splatting for Large-Scale Scene Reconstruction
Weiyi Xue, Fan Lu, Chi Zhang +6
UniviewVLA: A Unified Multiview Vision-Language-Action Model with World Modeling
Tao Xu, Runhao Zhang, Zhijian Huang +7
RCDN: Towards Robust Camera-Insensitivity Collaborative Perception via Dynamic Feature-based 3D Neural Modeling
Tianhang Wang, Fan Lu, Zehan Zheng +3
Promotional effect on cold start problem and diversity in a data characteristic based recommendation method
Tian Qiu, Zi-Ke Zhang, Guang Chen
A Graph-Neural-Network-Entropy model of vital node identification on network attack and propagation
Huaizhi Liao, Tian Qiu, Guang Chen
PointForward: Feedforward Driving Reconstruction through Point-Aligned Representations
Cheng Chi, Xianqi Wang, Hongcheng Luo +9
Salience Biased Loss for Object Detection in Aerial Images
Peng Sun, Guang Chen, Guerdan Luke +1
Modality-Agnostic Debiasing for Single Domain Generalization
Sanqing Qu, Yingwei Pan, Guang Chen +3
Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation
Di Zhang, Weicheng Duan, Dasen Gu +5
LiDAR4D: Dynamic Neural Fields for Novel Space-time View LiDAR Synthesis
Zehan Zheng, Fan Lu, Weiyi Xue +2
Multi-Agent Reinforcement Learning for Autonomous Driving: A Survey
Ruiqi Zhang, Jing Hou, Florian Walter +7
Pondering the Way: Spatial-perceiving World Action Model for Embodied Navigation
Hong Chen, Daqi Liu, Zehan Zhang +10
LEAD: Learning Decomposition for Source-free Universal Domain Adaptation
Sanqing Qu, Tianpei Zou, Lianghua He +4
NeuralPCI: Spatio-temporal Neural Field for 3D Point Cloud Multi-frame Non-linear Interpolation
Zehan Zheng, Danni Wu, Ruisi Lu +3
TUMTraf EMOT: Event-Based Multi-Object Tracking Dataset and Baseline for Traffic Scenarios
Mengyu Li, Xingcheng Zhou, Guang Chen +2
Beyond Intermediate States: Explaining Visual Redundancy through Language
Dingchen Yang, Bowen Cao, Anran Zhang +3
UMC: A Unified Bandwidth-efficient and Multi-resolution based Collaborative Perception Framework
Tianhang Wang, Guang Chen, Kai Chen +4
Thinking With Bounding Boxes: Enhancing Spatio-Temporal Video Grounding via Reinforcement Fine-Tuning
Xin Gu, Haoji Zhang, Qihang Fan +7
Indirect and Direct Training of Spiking Neural Networks for End-to-End Control of a Lane-Keeping Vehicle
Zhenshan Bing, Claus Meschede, Guang Chen +2
Dual-Stream Transformer for Generic Event Boundary Captioning
Xin Gu, Hanhua Ye, Guang Chen +3
Towards Low-Resource Harmful Meme Detection with LMM Agents
Jianzhao Huang, Hongzhan Lin, Ziyan Liu +3
GarchingSim: An Autonomous Driving Simulator with Photorealistic Scenes and Minimalist Workflow
Liguo Zhou, Yinglei Song, Yichao Gao +10
TGT: Text-Grounded Trajectories for Locally Controlled Video Generation
Guofeng Zhang, Angtian Wang, Jacob Zhiyuan Fang +8
Range and Bird's Eye View Fused Cross-Modal Visual Place Recognition
Jianyi Peng, Fan Lu, Bin Li +3
MutualVPR: A Mutual Learning Framework for Resolving Supervision Inconsistencies via Adaptive Clustering
Qiwen Gu, Xufei Wang, Junqiao Zhao +4
Adaptive financial networks with static and dynamic thresholds
Tian Qiu, Bo Zheng, Guang Chen
Toward Physically Consistent Driving Video World Models under Challenging Trajectories
Jiawei Zhou, Zhenxin Zhu, Lingyi Du +10
GLC++: Source-Free Universal Domain Adaptation through Global-Local Clustering and Contrastive Affinity Learning
Sanqing Qu, Tianpei Zou, Florian Röhrbein +4
Artificial intelligence in drug discovery: A comprehensive review with a case study on hyperuricemia, gout arthritis, and hyperuricemic nephropathy
Junwei Su, Cheng Xin, Ao Shang +11
FinLMM-R1: Enhancing Financial Reasoning in LMM through Scalable Data and Reward Design
Kai Lan, Jiayong Zhu, Jiangtong Li +3