Publications (45)
DV-Matcher: Deformation-based Non-Rigid Point Cloud Matching Guided by Pre-trained Visual Features
Zhangquan Chen, Puhua Jiang, Ruqi Huang
Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh
Junhao Chen, Mingjin Chen, Henghaofan Zhang +10
Latent Space Representation for Shape Analysis and Learning
Ruqi Huang, Panos Achlioptas, Leonidas Guibas +1
DISCOVERSE: Efficient Robot Simulation in Complex High-Fidelity Environments
Yufei Jia, Guangyu Wang, Yuhang Dong +17
GS-Playground: A High-Throughput Photorealistic Simulator for Vision-Informed Robot Learning
Yufei Jia, Heng Zhang, Ziheng Zhang +39
LottieGPT: Tokenizing Vector Animation for Autoregressive Generation
Junhao Chen, Kejun Gao, Yuehan Cui +8
Topology-Agnostic Animal Motion Generation from Text Prompt
Keyi Chen, Mingze Sun, Zhenyu Liu +2
Try Once, Then Optimal: De-Redundified Procedure Memory for Cross-Episode Exploration Amortization
Haizhou Ge, Haochen Ouyang, Zhixing Chen +6
Seeing Space and Motion: Enhancing Latent Actions with Geometric and Dynamic Awareness for Vision-Language-Action Models
Zhejia Cai, Yandan Yang, Xinyuan Chang +5
FILIC: Dual-Loop Force-Guided Imitation Learning with Impedance Torque Control for Contact-Rich Manipulation Tasks
Haizhou Ge, Yufei Jia, Zheng Li +6
OmniSeg3D: Omniversal 3D Segmentation via Hierarchical Contrastive Learning
Haiyang Ying, Yixuan Yin, Jinzhi Zhang +4
OperatorNet: Recovering 3D Shapes From Difference Operators
Ruqi Huang, Marie-Julie Rakotosaona, Panos Achlioptas +2
DANTE-W: Diffuse Albedo Neural Texturing in the Wild
Guangyu Wang, Tianheng Lu, Ruqi Huang +1
Cross-Camera Deep Colorization
Yaping Zhao, Haitian Zheng, Mengqi Ji +1
SEGA: Drivable 3D Gaussian Head Avatar from a Single Image
Chen Guo, Zhuo Su, Liao Wang +8
DanceTogether! Identity-Preserving Multi-Person Interactive Video Generation
Junhao Chen, Mingjin Chen, Jianjin Xu +9
OmniVideo-R1: Reinforcing Audio-visual Reasoning with Query Intention and Modality Attention
Zhangquan Chen, Jiale Tao, Ruihuang Li +10
Beyond Talking -- Generating Holistic 3D Human Dyadic Motion for Communication
Mingze Sun, Chao Xu, Xinyu Jiang +3
Non-Rigid Shape Registration via Deep Functional Maps Prior
Puhua Jiang, Mingze Sun, Ruqi Huang
When Video Misreads: Closed-Loop Distillation of Reading Heuristics for Exploratory Manipulation Trace QA
Haizhou Ge, Yufei Jia, Yue Li +5
Engine-Native Editable 3D World Reconstruction with Objects and Lighting
Junhao Chen, Xinghao Chen, Henghaofan Zhang +8
SIFThinker: Spatially-Aware Image Focus for Visual Reasoning
Zhangquan Chen, Ruihui Zhao, Chuwei Luo +4
Exposure Bias Can Alleviate Itself via Directional and Frequency Rectification in Flow Matching
Guanbo Huang, Jingjia Mao, Fanding Huang +9
PairCoder++: Pair Programming as a Universal Paradigm for Verified Code-Driven Multimodal and Structured-Artifact Generation
Junhao Chen, Xiang Li, Mingjin Chen +9
SRIF: Semantic Shape Registration Empowered by Diffusion-based Image Morphing and Flow Estimation
Mingze Sun, Chen Guo, Puhua Jiang +3
ARMO: Autoregressive Rigging for Multi-Category Objects
Mingze Sun, Shiwei Mao, Keyi Chen +5
Combo: Co-speech holistic 3D human motion generation and efficient customizable adaptation in harmony
Chao Xu, Mingze Sun, Zhi-Qi Cheng +5
4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understanding
Zhangquan Chen, Manyuan Zhang, Xinlei Yu +9
Animator-Centric Skeleton Generation on Objects with Fine-Grained Details
Mingze Sun, Cheng Zeng, Jiansong Pei +7
Optical Neural Ordinary Differential Equations
Yun Zhao, Hang Chen, Min Lin +5
Think with 3D: Geometric Imagination Grounded Spatial Reasoning from Limited Views
Zhangquan Chen, Manyuan Zhang, Xinlei Yu +8
Improving Multi-View Reconstruction via Texture-Guided Gaussian-Mesh Joint Optimization
Zhejia Cai, Puhua Jiang, Shiwei Mao +2
UniLab: A Heterogeneous Architecture for Robot RL Beyond GPU-Dominant Paradigms
Yufei Jia, Zhanxiang Cao, Mingrui Yu +48
EFENet: Reference-based Video Super-Resolution with Enhanced Flow Estimation
Yaping Zhao, Mengqi Ji, Ruqi Huang +2
One Video, One World: Turning Monocular Video into Physical 4D Scenes
Junhao Chen, Boran Zhang, Mingjin Chen +7
The Latent Space: Foundation, Evolution, Mechanism, Ability, and Outlook
Xinlei Yu, Zhangquan Chen, Yongbo He +36
NFR: Neural Feature-Guided Non-Rigid Shape Registration
Zhangquan Chen, Puhua Jiang, Mingze Sun +1
DynamicTrack: Advancing Gigapixel Tracking in Crowded Scenes
Yunqi Zhao, Yuchen Guo, Zheng Cao +3
DRiVE: Diffusion-based Rigging Empowers Generation of Versatile and Expressive Characters
Mingze Sun, Junhao Chen, Junting Dong +7
Spatially and Spectrally Consistent Deep Functional Maps
Mingze Sun, Shiwei Mao, Puhua Jiang +2
ControlGS: Consistent Structural Compression Control for Deployment-Aware Gaussian Splatting
Fengdi Zhang, Yibao Sun, Hongkun Cao +1
Neural Intrinsic Embedding for Non-rigid Point Cloud Matching
Puhua Jiang, Mingze Sun, Ruqi Huang
Bunraku: Turning a Single Illustration into an Editable Live2D Character
Junhao Chen, Jingjia Mao, Dayong Li +6
The paper introduces Bunraku, a system that automatically creates a complete Live2D character—including layered RGBA images, deformation meshes, and animation keyposes—from a singl…
Agogic: Performance-Timed Music Tokens for LLM-Native Text-to-Symbolic-Music Generation
Junhao Chen, Mingjin Chen, Jingjia Mao +12
XScale-NVS: Cross-Scale Novel View Synthesis with Hash Featurized Manifold
Guangyu Wang, Jinzhi Zhang, Fan Wang +2