papers

Publications (100)

cs.CV2026

MotionVLA: Vision-Language-Action Model for Humanoid Motion

Nonghai Zhang, Siyu Zhai, Yanjun Li +5

cs.CV2025

Reconstructing Satellites in 3D from Amateur Telescope Images

Zhiming Chang, Boyang Liu, Yifei Xia +3

cs.RO2024

SymmeTac: Symmetric Color LED Driven Efficient Photometric Stereo Reconstruction Methods for Camera-based Tactile Sensors

Jieji Ren, Heng Guo, Zaiyan Yang +6

cs.CV2024

Language-guided Image Reflection Separation

Haofeng Zhong, Yuchen Hong, Shuchen Weng +2

cs.CV2026

GeneralVLA-2: Geometry-Aware Reconstruction and Governed Memory for Robot Planning

Haoyu Wang, Guoqing Ma, Zeyu Zhang +3

cs.CV2026

High-Resolution Single-Shot Polarimetric Imaging Made Easy

Shuangfan Zhou, Chu Zhou, Heng Guo +4

cs.CV2022

NeIF: Representing General Reflectance as Neural Intrinsics Fields for Uncalibrated Photometric Stereo

Zongrui Li, Qian Zheng, Feishi Wang +3

cs.LG2018

Robust Student Network Learning

Tianyu Guo, Chang Xu, Shiyi He +3

cs.CV2025

Learning to Deblur Polarized Images

Chu Zhou, Minggui Teng, Xinyu Zhou +3

cs.CV2026

Stokes-Informed Diffusion for Robust Linear Polarization Estimation

Yidong Luo, Chenggong Li, Yuchao Feng +3

cs.CV2024

DreamPolish: Domain Score Distillation With Progressive Geometry Generation

Yean Cheng, Ziqi Cai, Ming Ding +5

cs.CV2026

MAVIN: Multi-Shot Audio-Visual Generation with Customized Narrative Control

Kaiqi Liu, Yunyao Mao, Ziqi Cai +8

MAVIN is a framework for generating multi-shot audio‑visual content with fine‑grained narrative control, using boundary‑aware attention to align temporal segments and ID‑aware prop…

#audio-visual generation#multi-shot video synthesis#narrative control#temporal alignment
cs.CV2026

Dark-EvGS: Event Camera as an Eye for Radiance Field in the Dark

Jingqian Wu, Peiqi Duan, Zongqiang Wang +3

cs.CV2025

AdaptiveAE: An Adaptive Exposure Strategy for HDR Capturing in Dynamic Scenes

Tianyi Xu, Fan Zhang, Boxin Shi +2

cs.CV2023

EvPlug: Learn a Plug-and-Play Module for Event and Image Fusion

Jianping Jiang, Xinyu Zhou, Peiqi Duan +1

cs.CV2026

PolGS++: Physically-Guided Polarimetric Gaussian Splatting for Fast Reflective Surface Reconstruction

Yufei Han, Chu Zhou, Youwei Lyu +6

cs.CV2025

PIDSR: Complementary Polarized Image Demosaicing and Super-Resolution

Shuangfan Zhou, Chu Zhou, Youwei Lyu +4

cs.CV2021

AdderNet: Do We Really Need Multiplications in Deep Learning?

Hanting Chen, Yunhe Wang, Chunjing Xu +4

cs.CV2019

Event-driven Video Frame Synthesis

Zihao W. Wang, Weixin Jiang, Kuan He +3

cs.CV2025

Affective Image Editing: Shaping Emotional Factors via Text Descriptions

Peixuan Zhang, Shuchen Weng, Chengxuan Zhu +4

cs.CV2020

Distilling portable Generative Adversarial Networks for Image Translation

Hanting Chen, Yunhe Wang, Han Shu +5

cs.CV2025

PolarAnything: Diffusion-based Polarimetric Image Synthesis

Kailong Zhang, Youwei Lyu, Heng Guo +3

cs.CV2024

Complementing Event Streams and RGB Frames for Hand Mesh Reconstruction

Jianping Jiang, Xinyu Zhou, Bingxuan Wang +3

cs.CV2020

DIST: Rendering Deep Implicit Signed Distance Function with Differentiable Sphere Tracing

Shaohui Liu, Yinda Zhang, Songyou Peng +3

cs.CV2022

NeuralMPS: Non-Lambertian Multispectral Photometric Stereo via Spectral Reflectance Decomposition

Jipeng Lv, Heng Guo, Guanying Chen +2

cs.CV2025

V2V: Scaling Event-Based Vision through Efficient Video-to-Voxel Simulation

Hanyue Lou, Jinxiu Liang, Minggui Teng +2

cs.CV2024

Deep Learning Methods for Calibrated Photometric Stereo and Beyond

Yakun Ju, Kin-Man Lam, Wuyuan Xie +3

cs.CV2024

NeRSP: Neural 3D Reconstruction for Reflective Objects with Sparse Polarized Images

Yufei Han, Heng Guo, Koki Fukai +5

cs.CV2025

PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms

Yifei Xia, Shuchen Weng, Siqi Yang +6

cs.CV2024

Real-time 3D-aware Portrait Video Relighting

Ziqi Cai, Kaiwen Jiang, Shu-Yu Chen +4

cs.CV2026

EvalMVX: A Unified Benchmarking for Neural 3D Reconstruction under Diverse Multiview Setups

Zaiyan Yang, Jieji Ren, Xiangyi Wang +5

cs.CV2025

Reconstruction as a Bridge for Event-Based Visual Question Answering

Hanyue Lou, Jiayi Zhou, Yang Zhang +4

cs.CV2026

A Benchmark and Multi-Agent System for Instruction-driven Cinematic Video Compilation

Peixuan Zhang, Chang Zhou, Ziyuan Zhang +8

cs.RO2026

Lift3D-VLA: Lifting VLA Models to 3D Geometry and Dynamics-Aware Manipulation

Jiaming Liu, Qingpo Wuwu, Nuowei Han +8

cs.CV2025

Towards Deeper Emotional Reflection: Crafting Affective Image Filters with Generative Priors

Peixuan Zhang, Shuchen Weng, Jiajun Tang +2

cs.CV2025

The NeRF Signature: Codebook-Aided Watermarking for Neural Radiance Fields

Ziyuan Luo, Anderson Rocha, Boxin Shi +3

cs.CV2023

EvHandPose: Event-based 3D Hand Pose Estimation with Sparse Supervision

Jianping Jiang, Jiahe Li, Baowen Zhang +2

cs.CV2023

Self-Supervised Scene Dynamic Recovery from Rolling Shutter Images and Events

Yangguang Wang, Xiang Zhang, Mingyuan Lin +4

cs.CV2023

L-CAD: Language-based Colorization with Any-level Descriptions using Diffusion Priors

Zheng Chang, Shuchen Weng, Peixuan Zhang +3

cs.CV2018

CRRN: Multi-Scale Guided Concurrent Reflection Removal Network

Renjie Wan, Boxin Shi, Ling-Yu Duan +2

cs.CV2022

Edge-preserving Near-light Photometric Stereo with Neural Surfaces

Heng Guo, Hiroaki Santo, Boxin Shi +1

cs.CV2017

Saliency Detection by Forward and Backward Cues in Deep-CNNs

Nevrez Imamoglu, Chi Zhang, Wataru Shimoda +2

cs.LG2020

On Positive-Unlabeled Classification in GAN

Tianyu Guo, Chang Xu, Jiajun Huang +4

cs.CV2023

Surface Geometry Processing: An Efficient Normal-based Detail Representation

Wuyuan Xie, Miaohui Wang, Di Lin +2

cs.CV2026

Video Generation Models Are Inherent Lighting Estimators

Ziqi Cai, Shuchen Weng, Kaiqi Liu +5

cs.CV2020

Hyperspectral City V1.0 Dataset and Benchmark

Shaodi You, Erqi Huang, Shuaizhe Liang +14

cs.CV2025

Personalized Image Filter: Mastering Your Photographic Style

Chengxuan Zhu, Shuchen Weng, Jiacong Fang +4

cs.CV2025

BokehDiff: Neural Lens Blur with One-Step Diffusion

Chengxuan Zhu, Qingnan Fan, Qi Zhang +4

cs.CV2019

Self-calibrating Deep Photometric Stereo Networks

Guanying Chen, Kai Han, Boxin Shi +2

cs.CV2026

ReContraster: Making Your Posters Stand Out with Regional Contrast

Peixuan Zhang, Zijian Jia, Ziqi Cai +3

cs.CV2019

SPLINE-Net: Sparse Photometric Stereo through Lighting Interpolation and Normal Estimation Networks

Qian Zheng, Yiming Jia, Boxin Shi +3

cs.LG2019

Data-Free Learning of Student Networks

Hanting Chen, Yunhe Wang, Chang Xu +6

cs.CR2025

Asynchronous Event Error-Minimizing Noise for Safeguarding Event Dataset

Ruofei Wang, Peiqi Duan, Boxin Shi +1

cs.CV2026

PolarVLM: Bridging the Semantic-Physical Gap in Vision-Language Models

Yuliang Li, Chu Zhou, Heng Guo +3

cs.CV2021

Label Distribution Amendment with Emotional Semantic Correlations for Facial Expression Recognition

Shasha Mao, Guanghui Shi, Licheng Jiao +4

cs.CV2026

STAGE: Storyboard-Anchored Generation for Cinematic Multi-shot Narrative

Peixuan Zhang, Zijian Jia, Kaiqi Liu +3

cs.CV2025

EvTurb: Event Camera Guided Turbulence Removal

Yixing Liu, Minggui Teng, Yifei Xia +2

cs.CV2024

SpikeNVS: Enhancing Novel View Synthesis from Blurry Images via Spike Camera

Gaole Dai, Zhenyu Wang, Qinwen Xu +5

cs.CV2023

EventAid: Benchmarking Event-aided Image/Video Enhancement Algorithms with Real-captured Hybrid Dataset

Peiqi Duan, Boyu Li, Yixin Yang +4

cs.CV2023

DANI-Net: Uncalibrated Photometric Stereo by Differentiable Shadow Handling, Anisotropic Reflectance Modeling, and Neural Inverse Rendering

Zongrui Li, Qian Zheng, Boxin Shi +2

cs.CV2020

Deep Photometric Stereo for Non-Lambertian Surfaces

Guanying Chen, Kai Han, Boxin Shi +2

cs.CV2021

DeRenderNet: Intrinsic Image Decomposition of Urban Scenes with Shape-(In)dependent Shading Rendering

Yongjie Zhu, Jiajun Tang, Si Li +1

cs.CV2019

Face Image Reflection Removal

Renjie Wan, Boxin Shi, Haoliang Li +2

cs.CV2025

PolGS: Polarimetric Gaussian Splatting for Fast Reflective Surface Reconstruction

Yufei Han, Bowen Tie, Heng Guo +5

cs.CV2024

Spin-UP: Spin Light for Natural Light Uncalibrated Photometric Stereo

Zongrui Li, Zhan Lu, Haojie Yan +4

cs.CV2021

Spatially-Varying Outdoor Lighting Estimation from Intrinsics

Yongjie Zhu, Yinda Zhang, Si Li +1

cs.CV2024

Colorizing Monochromatic Radiance Fields

Yean Cheng, Renjie Wan, Shuchen Weng +3

cs.CV2026

Near-Light Color Photometric Stereo for Mono-Chromatic Non-Lambertian Surfaces

Zonglin Li, Jieji Ren, Shuangfan Zhou +6

cs.CV2023

Spike Stream Denoising via Spike Camera Simulation

Liwen hu, Lei Ma, Zhaofei Yu +2

cs.CV2025

NTIRE 2025 Challenge on Event-Based Image Deblurring: Methods and Results

Lei Sun, Andrea Alfarano, Peiqi Duan +85

cs.AR2025

No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering

Linye Wei, Jiajun Tang, Fan Fei +3

cs.CV2024

Pano-NeRF: Synthesizing High Dynamic Range Novel Views with Geometry from Sparse Low Dynamic Range Panoramic Images

Zhan Lu, Qian Zheng, Boxin Shi +1

cs.CV2024

L-C4: Language-Based Video Colorization for Creative and Consistent Color

Zheng Chang, Shuchen Weng, Huan Ouyang +3

cs.CV2022

Real-Time Intermediate Flow Estimation for Video Frame Interpolation

Zhewei Huang, Tianyuan Zhang, Wen Heng +2

cs.CV2026

High-Speed Full-Color HDR Imaging via Unwrapping Modulo-Encoded Spike Streams

Chu Zhou, Siqi Yang, Kailong Zhang +4

cs.CV2026

Lighting-grounded Video Generation with Renderer-based Agent Reasoning

Ziqi Cai, Taoyu Yang, Zheng Chang +4

cs.LG2025

TRIDENT: A Trimodal Cascade Generative Framework for Drug and RNA-Conditioned Cellular Morphology Synthesis

Rui Peng, Ziru Liu, Lingyuan Ye +3

cs.CV2024

Technique Report of CVPR 2024 PBDL Challenges

Ying Fu, Yu Li, Shaodi You +96

cs.LG2020

Beyond Dropout: Feature Map Distortion to Regularize Deep Neural Networks

Yehui Tang, Yunhe Wang, Yixing Xu +4

cs.CV2020

CARS: Continuous Evolution for Efficient Neural Architecture Search

Zhaohui Yang, Yunhe Wang, Xinghao Chen +5

cs.CV2026

PolarVSR: A Unified Framework and Benchmark for Continuous Space-Time Polarization Video Reconstruction

Chenggong Li, Yidong Luo, Junchao Zhang +2

eess.IV2026

Architectural Unification for Polarimetric Imaging Across Multiple Degradations

Chu Zhou, Yufei Han, Junda Liao +6

cs.CV2026

PolarAPP: Beyond Polarization Demosaicking for Polarimetric Applications

Yidong Luo, Chenggong Li, Yunfeng Song +4

cs.LG2019

Bringing Giant Neural Networks Down to Earth with Unlabeled Data

Yehui Tang, Shan You, Chang Xu +2

cs.CV2025

SweepEvGS: Event-Based 3D Gaussian Splatting for Macro and Micro Radiance Field Rendering from a Single Sweep

Jingqian Wu, Shuo Zhu, Chutian Wang +2

cs.CV2025

VIRES: Video Instance Repainting via Sketch and Text Guided Generation

Shuchen Weng, Haojie Zheng, Peixuan Zhang +4

cs.CV2026

PacTure: Efficient PBR Texture Generation on Packed Views with Visual Autoregressive Models

Fan Fei, Jiajun Tang, Fei-Peng Tian +2

cs.CV2026

AVI-Edit: Audio-sync Video Instance Editing with Granularity-Aware Mask Refiner

Haojie Zheng, Shuchen Weng, Jingqi Liu +3

cs.CV2024

E2VIDiff: Perceptual Events-to-Video Reconstruction using Diffusion Priors

Jinxiu Liang, Bohan Yu, Yixin Yang +2

cs.CV2022

Optical Flow Estimation for Spiking Camera

Liwen Hu, Rui Zhao, Ziluo Ding +4

cs.CV2026

Light of Normals: Unified Feature Representation for Universal Photometric Stereo

Houyuan Chen, Hong Li, Chongjie Ye +11

cs.CV2026

InstructAV2AV: Instruction-Guided Audio-Video Joint Editing

Haojie Zheng, Yixin Yang, Siqi Yang +2

cs.CV2020

A Semi-Supervised Assessor of Neural Architectures

Yehui Tang, Yunhe Wang, Yixing Xu +6

cs.CV2025

Audio-Sync Video Generation with Multi-Stream Temporal Control

Shuchen Weng, Haojie Zheng, Zheng Chang +3

cs.CV2024

Imaging Interiors: An Implicit Solution to Electromagnetic Inverse Scattering Problems

Ziyuan Luo, Boxin Shi, Haoliang Li +1

cs.CV2022

1000x Faster Camera and Machine Vision with Ordinary Devices

Tiejun Huang, Yajing Zheng, Zhaofei Yu +13

cs.RO2026

Video2Act: A Dual-System Video Diffusion Policy with Robotic Spatio-Motional Modeling

Yueru Jia, Jiaming Liu, Shengbang Liu +7

cs.RO2026

TACO: TActile World Model as a Self-COrrector forScalable VLA Post-Training

Shengbang Liu, Yueru Jia, Yuyang Yan +7

cs.CV2020

Deep Shape from Polarization

Yunhao Ba, Alex Ross Gilbert, Franklin Wang +6

cs.CV2020

Multi-View Photometric Stereo: A Robust Solution and Benchmark Dataset for Spatially Varying Isotropic Materials

Min Li, Zhenglong Zhou, Zhe Wu +3