Publications (69)
A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation
Liping Wang, Cheng Ye, Weidong Chen +3
HTT-Net: Hierarchical Text-guided Transition Modeling for Surgical Video Phase Recognition
Kunjie Deng, Jinghui Zhang, Weidong Chen +4
SALT: A Flexible Semi-Automatic Labeling Tool for General LiDAR Point Clouds with Cross-Scene Adaptability and 4D Consistency
Yanbo Wang, Yongtao Chen, Chuan Cao +4
Towards Accurate Emotion-Attributed Video Captioning via Fine-grained Emotion-Cause Pair Extraction
Weidong Chen, Cheng Ye, Zhendong Mao +3
Decomposition of loop spaces and periodic problem on $Ï_*$
Weidong Chen, Jie Wu
SN-LiDAR: Semantic Neural Fields for Novel Space-time View LiDAR Synthesis
Yi Chen, Tianchen Deng, Wentao Zhao +4
Design and Koopman Model Predictive Control of A Soft Exoskeleton Based on Origami-Inspired Pneumatic Actuator for Knee Rehabilitation
Junxiang Wang, Han Zhang, Zehao Wang +3
Domain-invariant Similarity Activation Map Contrastive Learning for Retrieval-based Long-term Visual Localization
Hanjiang Hu, Hesheng Wang, Zhe Liu +1
PLGSLAM: Progressive Neural Scene Represenation with Local to Global Bundle Adjustment
Tianchen Deng, Guole Shen, Tong Qin +5
Multi-Modal UAV Detection, Classification and Tracking Algorithm -- Technical Report for CVPR 2024 UG2 Challenge
Tianchen Deng, Yi Zhou, Wenhua Wu +9
Incremental Joint Learning of Depth, Pose and Implicit Scene Representation on Monocular Camera in Large-scale Scenes
Tianchen Deng, Nailin Wang, Chongdi Wang +5
MCN-SLAM: Multi-Agent Collaborative Neural SLAM with Hybrid Implicit Neural Scene Representation
Tianchen Deng, Guole Shen, Xun Chen +9
DrawSpeech: Expressive Speech Synthesis Using Prosodic Sketches as Control Conditions
Weidong Chen, Shan Yang, Guangzhi Li +1
SpeechFormer: A Hierarchical Efficient Framework Incorporating the Characteristics of Speech
Weidong Chen, Xiaofen Xing, Xiangmin Xu +2
The Dawn of Video Generation: Preliminary Explorations with SORA-like Models
Ailing Zeng, Yuhang Yang, Weidong Chen +1
CreatiParser: Generative Image Parsing of Raster Graphic Designs into Editable Layers
Weidong Chen, Dexiang Hong, Zhendong Mao +4
The paper introduces CreatiParser, a hybrid generative system that converts raster graphic design images into editable layers (text, background, stickers) using a vision-language m…
Unified Unsupervised and Sparsely-Supervised 3D Object Detection by Semantic Pseudo-Labeling and Prototype Learning
Yushen He, Lei Zhao, Weidong Chen
SpeechFormer++: A Hierarchical Efficient Framework for Paralinguistic Speech Processing
Weidong Chen, Xiaofen Xing, Xiangmin Xu +2
Machine learning prediction of plasma behavior from discharge configurations on WEST
Chenguang Wan, Feda Almuhisen, Philippe Moreau +10
Sentiment-oriented Transformer-based Variational Autoencoder Network for Live Video Commenting
Fengyi Fu, Shancheng Fang, Weidong Chen +1
Scene-Agnostic Traversability Labeling and Estimation via a Multimodal Self-supervised Framework
Zipeng Fang, Yanbo Wang, Lei Zhao +1
Chaotic synchronization in optical frequency combs
Günter Steinmeyer, Weidong Chen
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
Peipei Song, Long Zhang, Long Lan +4
Audio-Visual Exchange-Aware Token Pruning for Efficient Audio-Visual Captioning
Zihan Meng, Dexiang Hong, Weidong Chen +3
CT-VoxelMap: Efficient Continuous-Time LiDAR-Inertial Odometry with Probabilistic Adaptive Voxel Mapping
Lei Zhao, Xingyi Li, Tianchen Deng +3
Dynamic Parameter Memory: Temporary LoRA-Enhanced LLM for Long-Sequence Emotion Recognition in Conversation
Jialong Mai, Xiaofen Xing, Yawei Li +4
Lexical Acquisition via Constraint Solving
Ted Pedersen, Weidong Chen
Tagging like Humans: Diverse and Distinct Image Annotation
Baoyuan Wu, Weidong Chen, Peng Sun +3
Dual-path Collaborative Generation Network for Emotional Video Captioning
Cheng Ye, Weidong Chen, Jingyu Li +2
DWFormer: Dynamic Window transFormer for Speech Emotion Recognition
Shuaiqi Chen, Xiaofen Xing, Weibin Zhang +2
Unsupervised Learning of Monocular Depth and Ego-Motion Using Multiple Masks
Guangming Wang, Hesheng Wang, Yiling Liu +1
Geometry-aware Gaussian Prior and Axial Attention for Cervical Cytology Image Classification
Yating Li, Cheng Ye, Nenan Lyu +2
An Efficient LiDAR-Camera Fusion Network for Multi-Class 3D Dynamic Object Detection and Trajectory Prediction
Yushen He, Lei Zhao, Tianchen Deng +2
Emergent Bio-Functional Similarities in a Cortical-Spike-Train-Decoding Spiking Neural Network Facilitate Predictions of Neural Computation
Tengjun Liu, Yansong Chua, Yiwei Zhang +6
Saliency Fusion in Eigenvector Space with Multi-Channel Pulse Coupled Neural Network
Nevrez Imamoglu, Zhixuan Wei, Huangjun Shi +7
MNV-17: A High-Quality Performative Mandarin Dataset for Nonverbal Vocalization Recognition in Speech
Jialong Mai, Jinxin Ji, Xiaofen Xing +4
EmoVerse: A MLLMs-Driven Emotion Representation Dataset for Interpretable Visual Emotion Analysis
Yijie Guo, Dexiang Hong, Weidong Chen +4
A 4D Radar Camera Extrinsic Calibration Tool Based on 3D Uncertainty Perspective N Points
Chuan Cao, Xiaoning Wang, Wenqian Xi +3
U-OBCA: Uncertainty-Aware Optimization-Based Collision Avoidance via Wasserstein Distributionally Robust Chance Constraints
Zehao Wang, Yuxuan Tang, Han Zhang +2
HistLLM: A Unified Framework for LLM-Based Multimodal Recommendation with User History Encoding and Compression
Chen Zhang, Bo Hu, Weidong Chen +1
Multi-Attention Network for Compressed Video Referring Object Segmentation
Weidong Chen, Dexiang Hong, Yuankai Qi +5
Graph Mixture of Experts and Memory-augmented Routers for Multivariate Time Series Anomaly Detection
Xiaoyu Huang, Weidong Chen, Bo Hu +1
Sex Differences in Severity and Mortality Among Patients With COVID-19: Evidence from Pooled Literature Analysis and Insights from Integrated Bioinformatic Analysis
Xiyi Wei, Yu-Tian Xiao, Jian Wang +12
Key-Sparse Transformer for Multimodal Speech Emotion Recognition
Weidong Chen, Xiaofeng Xing, Xiangmin Xu +2
LSSED: a large-scale dataset and benchmark for speech emotion recognition
Weiquan Fan, Xiangmin Xu, Xiaofen Xing +2
What Is The Best 3D Scene Representation for Robotics? From Geometric to Foundation Models
Tianchen Deng, Yue Pan, Shenghai Yuan +10
ROLL: Long-Term Robust LiDAR-based Localization With Temporary Mapping in Changing Environments
Bin Peng, Hongle Xie, Weidong Chen
Optimization-Based Trajectory Planning for Tractor-Trailer Vehicles on Curvy Roads: A Progressively Increasing Sampling Number Method
Zehao Wang, Han Zhang, Jingchuan Wang +1
FACE-net: Factual Calibration and Emotion Augmentation for Retrieval-enhanced Emotional Video Captioning
Weidong Chen, Cheng Ye, Zhendong Mao +5
NeSLAM: Neural Implicit Mapping and Self-Supervised Feature Tracking With Depth Completion and Denoising
Tianchen Deng, Yanbo Wang, Hongle Xie +4
Learning to Tune Like an Expert: Interpretable and Scene-Aware Navigation via MLLM Reasoning and CVAE-Based Adaptation
Yanbo Wang, Zipeng Fang, Lei Zhao +1
Tencent ML-Images: A Large-Scale Multi-Label Image Database for Visual Representation Learning
Baoyuan Wu, Weidong Chen, Yanbo Fan +4
Novel Balanced Single/Dual-band Bandpass Filters Based on Circular Patch Resonator
Qiao Zhang, Chang Chen, Weidong Chen +2
The Second LoViF 2026 Challenge on Real-World All-in-One Image Restoration: Methods and Results
Xiang Chen, Hao Li, Jiangxin Dong +89
DST: Deformable Speech Transformer for Emotion Recognition
Weidong Chen, Xiaofen Xing, Xiangmin Xu +2
Retrieval-based Localization Based on Domain-invariant Feature Learning under Changing Environments
Hanjiang Hu, Hesheng Wang, Zhe Liu +3
EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation
Dexiang Hong, Yijie Guo, Weidong Chen +4
Imitation Learning for Elder-Facing Speech Synthesis
Dongrui Han, Weidong Chen, Jiawen Kang +3
SFPNet: Sparse Focal Point Network for Semantic Segmentation on General LiDAR Point Clouds
Yanbo Wang, Wentao Zhao, Chuan Cao +3
ProSGNeRF: Progressive Dynamic Neural Scene Graph with Frequency Modulated Foundation Model in Urban Scenes
Tianchen Deng, Yanbo Wang, Yejia Liu +5
A Note on the Inapproximability of Induced Disjoint Paths
Gaoxiu Dong, Weidong Chen
CreatiDesign: A Unified Multi-Conditional Diffusion Transformer for Creative Graphic Design
Hui Zhang, Dexiang Hong, Maoke Yang +7
Sub-ppb CO2 Detection based on Dissipative Whispering Gallery mode Microcavity Sensor
Shujing Ruan, Guangzhen Gao, Jianing Zhang +7
Vesper: A Compact and Effective Pretrained Model for Speech Emotion Recognition
Weidong Chen, Xiaofen Xing, Peihao Chen +1
Non-Invasive Temporal Interference Electrical Stimulation for Spinal Cord Injury Rehabilitation: A Simulation Study
Xu Xie, Yuchen Xu, Huilin Mou +7
Efficacy of Temporal Interference Electrical Stimulation for Spinal Cord Injury Rehabilitation: A Case Series
Ruidong Cheng, Yuling Shao, Xi Li +9
Improving Image Captioning via Predicting Structured Concepts
Ting Wang, Weidong Chen, Yuanhe Tian +2
Registering the 4D Millimeter Wave Radar Point Clouds Via Generalized Method of Moments
Xingyi Li, Han Zhang, Ziliang Wang +2
CreatiPoster: Towards Editable and Controllable Multi-Layer Graphic Design Generation
Zhao Zhang, Yutao Cheng, Weidong Chen +8