Publications (100)
MotionVLA: Vision-Language-Action Model for Humanoid Motion
Nonghai Zhang, Siyu Zhai, Yanjun Li +5
Reconstructing Satellites in 3D from Amateur Telescope Images
Zhiming Chang, Boyang Liu, Yifei Xia +3
SymmeTac: Symmetric Color LED Driven Efficient Photometric Stereo Reconstruction Methods for Camera-based Tactile Sensors
Jieji Ren, Heng Guo, Zaiyan Yang +6
Language-guided Image Reflection Separation
Haofeng Zhong, Yuchen Hong, Shuchen Weng +2
GeneralVLA-2: Geometry-Aware Reconstruction and Governed Memory for Robot Planning
Haoyu Wang, Guoqing Ma, Zeyu Zhang +3
High-Resolution Single-Shot Polarimetric Imaging Made Easy
Shuangfan Zhou, Chu Zhou, Heng Guo +4
NeIF: Representing General Reflectance as Neural Intrinsics Fields for Uncalibrated Photometric Stereo
Zongrui Li, Qian Zheng, Feishi Wang +3
Robust Student Network Learning
Tianyu Guo, Chang Xu, Shiyi He +3
Learning to Deblur Polarized Images
Chu Zhou, Minggui Teng, Xinyu Zhou +3
Stokes-Informed Diffusion for Robust Linear Polarization Estimation
Yidong Luo, Chenggong Li, Yuchao Feng +3
DreamPolish: Domain Score Distillation With Progressive Geometry Generation
Yean Cheng, Ziqi Cai, Ming Ding +5
MAVIN: Multi-Shot Audio-Visual Generation with Customized Narrative Control
Kaiqi Liu, Yunyao Mao, Ziqi Cai +8
MAVIN is a framework for generating multi-shot audio‑visual content with fine‑grained narrative control, using boundary‑aware attention to align temporal segments and ID‑aware prop…
Dark-EvGS: Event Camera as an Eye for Radiance Field in the Dark
Jingqian Wu, Peiqi Duan, Zongqiang Wang +3
AdaptiveAE: An Adaptive Exposure Strategy for HDR Capturing in Dynamic Scenes
Tianyi Xu, Fan Zhang, Boxin Shi +2
EvPlug: Learn a Plug-and-Play Module for Event and Image Fusion
Jianping Jiang, Xinyu Zhou, Peiqi Duan +1
PolGS++: Physically-Guided Polarimetric Gaussian Splatting for Fast Reflective Surface Reconstruction
Yufei Han, Chu Zhou, Youwei Lyu +6
PIDSR: Complementary Polarized Image Demosaicing and Super-Resolution
Shuangfan Zhou, Chu Zhou, Youwei Lyu +4
AdderNet: Do We Really Need Multiplications in Deep Learning?
Hanting Chen, Yunhe Wang, Chunjing Xu +4
Event-driven Video Frame Synthesis
Zihao W. Wang, Weixin Jiang, Kuan He +3
Affective Image Editing: Shaping Emotional Factors via Text Descriptions
Peixuan Zhang, Shuchen Weng, Chengxuan Zhu +4
Distilling portable Generative Adversarial Networks for Image Translation
Hanting Chen, Yunhe Wang, Han Shu +5
PolarAnything: Diffusion-based Polarimetric Image Synthesis
Kailong Zhang, Youwei Lyu, Heng Guo +3
Complementing Event Streams and RGB Frames for Hand Mesh Reconstruction
Jianping Jiang, Xinyu Zhou, Bingxuan Wang +3
DIST: Rendering Deep Implicit Signed Distance Function with Differentiable Sphere Tracing
Shaohui Liu, Yinda Zhang, Songyou Peng +3
NeuralMPS: Non-Lambertian Multispectral Photometric Stereo via Spectral Reflectance Decomposition
Jipeng Lv, Heng Guo, Guanying Chen +2
V2V: Scaling Event-Based Vision through Efficient Video-to-Voxel Simulation
Hanyue Lou, Jinxiu Liang, Minggui Teng +2
Deep Learning Methods for Calibrated Photometric Stereo and Beyond
Yakun Ju, Kin-Man Lam, Wuyuan Xie +3
NeRSP: Neural 3D Reconstruction for Reflective Objects with Sparse Polarized Images
Yufei Han, Heng Guo, Koki Fukai +5
PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms
Yifei Xia, Shuchen Weng, Siqi Yang +6
Real-time 3D-aware Portrait Video Relighting
Ziqi Cai, Kaiwen Jiang, Shu-Yu Chen +4
EvalMVX: A Unified Benchmarking for Neural 3D Reconstruction under Diverse Multiview Setups
Zaiyan Yang, Jieji Ren, Xiangyi Wang +5
Reconstruction as a Bridge for Event-Based Visual Question Answering
Hanyue Lou, Jiayi Zhou, Yang Zhang +4
A Benchmark and Multi-Agent System for Instruction-driven Cinematic Video Compilation
Peixuan Zhang, Chang Zhou, Ziyuan Zhang +8
Lift3D-VLA: Lifting VLA Models to 3D Geometry and Dynamics-Aware Manipulation
Jiaming Liu, Qingpo Wuwu, Nuowei Han +8
Towards Deeper Emotional Reflection: Crafting Affective Image Filters with Generative Priors
Peixuan Zhang, Shuchen Weng, Jiajun Tang +2
The NeRF Signature: Codebook-Aided Watermarking for Neural Radiance Fields
Ziyuan Luo, Anderson Rocha, Boxin Shi +3
EvHandPose: Event-based 3D Hand Pose Estimation with Sparse Supervision
Jianping Jiang, Jiahe Li, Baowen Zhang +2
Self-Supervised Scene Dynamic Recovery from Rolling Shutter Images and Events
Yangguang Wang, Xiang Zhang, Mingyuan Lin +4
L-CAD: Language-based Colorization with Any-level Descriptions using Diffusion Priors
Zheng Chang, Shuchen Weng, Peixuan Zhang +3
CRRN: Multi-Scale Guided Concurrent Reflection Removal Network
Renjie Wan, Boxin Shi, Ling-Yu Duan +2
Edge-preserving Near-light Photometric Stereo with Neural Surfaces
Heng Guo, Hiroaki Santo, Boxin Shi +1
Saliency Detection by Forward and Backward Cues in Deep-CNNs
Nevrez Imamoglu, Chi Zhang, Wataru Shimoda +2
On Positive-Unlabeled Classification in GAN
Tianyu Guo, Chang Xu, Jiajun Huang +4
Surface Geometry Processing: An Efficient Normal-based Detail Representation
Wuyuan Xie, Miaohui Wang, Di Lin +2
Video Generation Models Are Inherent Lighting Estimators
Ziqi Cai, Shuchen Weng, Kaiqi Liu +5
Hyperspectral City V1.0 Dataset and Benchmark
Shaodi You, Erqi Huang, Shuaizhe Liang +14
Personalized Image Filter: Mastering Your Photographic Style
Chengxuan Zhu, Shuchen Weng, Jiacong Fang +4
BokehDiff: Neural Lens Blur with One-Step Diffusion
Chengxuan Zhu, Qingnan Fan, Qi Zhang +4
Self-calibrating Deep Photometric Stereo Networks
Guanying Chen, Kai Han, Boxin Shi +2
ReContraster: Making Your Posters Stand Out with Regional Contrast
Peixuan Zhang, Zijian Jia, Ziqi Cai +3
SPLINE-Net: Sparse Photometric Stereo through Lighting Interpolation and Normal Estimation Networks
Qian Zheng, Yiming Jia, Boxin Shi +3
Data-Free Learning of Student Networks
Hanting Chen, Yunhe Wang, Chang Xu +6
Asynchronous Event Error-Minimizing Noise for Safeguarding Event Dataset
Ruofei Wang, Peiqi Duan, Boxin Shi +1
PolarVLM: Bridging the Semantic-Physical Gap in Vision-Language Models
Yuliang Li, Chu Zhou, Heng Guo +3
Label Distribution Amendment with Emotional Semantic Correlations for Facial Expression Recognition
Shasha Mao, Guanghui Shi, Licheng Jiao +4
STAGE: Storyboard-Anchored Generation for Cinematic Multi-shot Narrative
Peixuan Zhang, Zijian Jia, Kaiqi Liu +3
EvTurb: Event Camera Guided Turbulence Removal
Yixing Liu, Minggui Teng, Yifei Xia +2
SpikeNVS: Enhancing Novel View Synthesis from Blurry Images via Spike Camera
Gaole Dai, Zhenyu Wang, Qinwen Xu +5
EventAid: Benchmarking Event-aided Image/Video Enhancement Algorithms with Real-captured Hybrid Dataset
Peiqi Duan, Boyu Li, Yixin Yang +4
DANI-Net: Uncalibrated Photometric Stereo by Differentiable Shadow Handling, Anisotropic Reflectance Modeling, and Neural Inverse Rendering
Zongrui Li, Qian Zheng, Boxin Shi +2
Deep Photometric Stereo for Non-Lambertian Surfaces
Guanying Chen, Kai Han, Boxin Shi +2
DeRenderNet: Intrinsic Image Decomposition of Urban Scenes with Shape-(In)dependent Shading Rendering
Yongjie Zhu, Jiajun Tang, Si Li +1
Face Image Reflection Removal
Renjie Wan, Boxin Shi, Haoliang Li +2
PolGS: Polarimetric Gaussian Splatting for Fast Reflective Surface Reconstruction
Yufei Han, Bowen Tie, Heng Guo +5
Spin-UP: Spin Light for Natural Light Uncalibrated Photometric Stereo
Zongrui Li, Zhan Lu, Haojie Yan +4
Spatially-Varying Outdoor Lighting Estimation from Intrinsics
Yongjie Zhu, Yinda Zhang, Si Li +1
Colorizing Monochromatic Radiance Fields
Yean Cheng, Renjie Wan, Shuchen Weng +3
Near-Light Color Photometric Stereo for Mono-Chromatic Non-Lambertian Surfaces
Zonglin Li, Jieji Ren, Shuangfan Zhou +6
Spike Stream Denoising via Spike Camera Simulation
Liwen hu, Lei Ma, Zhaofei Yu +2
NTIRE 2025 Challenge on Event-Based Image Deblurring: Methods and Results
Lei Sun, Andrea Alfarano, Peiqi Duan +85
No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering
Linye Wei, Jiajun Tang, Fan Fei +3
Pano-NeRF: Synthesizing High Dynamic Range Novel Views with Geometry from Sparse Low Dynamic Range Panoramic Images
Zhan Lu, Qian Zheng, Boxin Shi +1
L-C4: Language-Based Video Colorization for Creative and Consistent Color
Zheng Chang, Shuchen Weng, Huan Ouyang +3
Real-Time Intermediate Flow Estimation for Video Frame Interpolation
Zhewei Huang, Tianyuan Zhang, Wen Heng +2
High-Speed Full-Color HDR Imaging via Unwrapping Modulo-Encoded Spike Streams
Chu Zhou, Siqi Yang, Kailong Zhang +4
Lighting-grounded Video Generation with Renderer-based Agent Reasoning
Ziqi Cai, Taoyu Yang, Zheng Chang +4
TRIDENT: A Trimodal Cascade Generative Framework for Drug and RNA-Conditioned Cellular Morphology Synthesis
Rui Peng, Ziru Liu, Lingyuan Ye +3
Technique Report of CVPR 2024 PBDL Challenges
Ying Fu, Yu Li, Shaodi You +96
Beyond Dropout: Feature Map Distortion to Regularize Deep Neural Networks
Yehui Tang, Yunhe Wang, Yixing Xu +4
CARS: Continuous Evolution for Efficient Neural Architecture Search
Zhaohui Yang, Yunhe Wang, Xinghao Chen +5
PolarVSR: A Unified Framework and Benchmark for Continuous Space-Time Polarization Video Reconstruction
Chenggong Li, Yidong Luo, Junchao Zhang +2
Architectural Unification for Polarimetric Imaging Across Multiple Degradations
Chu Zhou, Yufei Han, Junda Liao +6
PolarAPP: Beyond Polarization Demosaicking for Polarimetric Applications
Yidong Luo, Chenggong Li, Yunfeng Song +4
Bringing Giant Neural Networks Down to Earth with Unlabeled Data
Yehui Tang, Shan You, Chang Xu +2
SweepEvGS: Event-Based 3D Gaussian Splatting for Macro and Micro Radiance Field Rendering from a Single Sweep
Jingqian Wu, Shuo Zhu, Chutian Wang +2
VIRES: Video Instance Repainting via Sketch and Text Guided Generation
Shuchen Weng, Haojie Zheng, Peixuan Zhang +4
PacTure: Efficient PBR Texture Generation on Packed Views with Visual Autoregressive Models
Fan Fei, Jiajun Tang, Fei-Peng Tian +2
AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner
Haojie Zheng, Shuchen Weng, Jingqi Liu +3
E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors
Jinxiu Liang, Bohan Yu, Yixin Yang +2
Optical Flow Estimation for Spiking Camera
Liwen Hu, Rui Zhao, Ziluo Ding +4
Light of Normals: Unified Feature Representation for Universal Photometric Stereo
Houyuan Chen, Hong Li, Chongjie Ye +11
InstructAV2AV: Instruction-Guided Audio-Video Joint Editing
Haojie Zheng, Yixin Yang, Siqi Yang +2
A Semi-Supervised Assessor of Neural Architectures
Yehui Tang, Yunhe Wang, Yixing Xu +6
Audio-Sync Video Generation with Multi-Stream Temporal Control
Shuchen Weng, Haojie Zheng, Zheng Chang +3
Imaging Interiors: An Implicit Solution to Electromagnetic Inverse Scattering Problems
Ziyuan Luo, Boxin Shi, Haoliang Li +1
1000x Faster Camera and Machine Vision with Ordinary Devices
Tiejun Huang, Yajing Zheng, Zhaofei Yu +13
Video2Act: A Dual-System Video Diffusion Policy with Robotic Spatio-Motional Modeling
Yueru Jia, Jiaming Liu, Shengbang Liu +7
TACO: TActile World Model as a Self-COrrector forScalable VLA Post-Training
Shengbang Liu, Yueru Jia, Yuyang Yan +7
Deep Shape from Polarization
Yunhao Ba, Alex Ross Gilbert, Franklin Wang +6
Multi-View Photometric Stereo: A Robust Solution and Benchmark Dataset for Spatially Varying Isotropic Materials
Min Li, Zhenglong Zhou, Zhe Wu +3