Publications (133)
Scale-aware Automatic Augmentation for Object Detection
Yukang Chen, Yanwei Li, Tao Kong +4
Boundedness in general type MMP
Jingjun Han, Lu Qi, Ziquan Zhuang
TMT-VIS: Taxonomy-aware Multi-dataset Joint Training for Video Instance Segmentation
Rongkun Zheng, Lu Qi, Xi Chen +4
Recover to Predict: Progressive Retrospective Learning for Variable-Length Trajectory Prediction
Hao Zhou, Lu Qi, Jason Li +5
A hardware-safety-gated system for LLM-written native ARTIQ control code on a trapped-ion platform
Duanyang Wang, Lu Qi, Yuanheng Xie +2
Visual Reasoning Tracer: Object-Level Grounded Reasoning Benchmark
Haobo Yuan, Yueyi Sun, Yanwei Li +7
Effective Adapter for Face Recognition in the Wild
Yunhao Liu, Yu-Ju Tsai, Kelvin C. K. Chan +3
On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification
Yongliang Wu, Yizhou Zhou, Zhou Ziheng +7
PANORAMA: The Rise of Omnidirectional Vision in the Embodied AI Era
Xu Zheng, Chenfei Liao, Ziqiao Weng +12
Image Synthesis via Semantic Composition
Yi Wang, Lu Qi, Ying-Cong Chen +2
A note on b-divisors and filtrations on a local ring
Lu Qi
NTIRE 2026 3D Restoration and Reconstruction in Real-world Adverse Conditions: RealX3D Challenge Results
Shuhong Liu, Chenyu Bao, Ziteng Cui +103
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
Mengshi Qi, Pengfei Zhu, Xiangtai Li +4
LLAVADI: What Matters For Multimodal Large Language Models Distillation
Shilin Xu, Xiangtai Li, Haobo Yuan +3
Multi-Scale Aligned Distillation for Low-Resolution Detection
Lu Qi, Jason Kuen, Jiuxiang Gu +5
HoliGS: Holistic Gaussian Splatting for Embodied View Synthesis
Xiaoyuan Wang, Yizhou Zhao, Botao Ye +6
Mamba or RWKV: Exploring High-Quality and High-Efficiency Segment Anything Model
Haobo Yuan, Xiangtai Li, Lu Qi +4
CA-SSL: Class-Agnostic Semi-Supervised Learning for Detection and Segmentation
Lu Qi, Jason Kuen, Zhe Lin +7
ICM-3D: Instantiated Category Modeling for 3D Instance Segmentation
Ruihang Chu, Yukang Chen, Tao Kong +2
PointINS: Point-based Instance Segmentation
Lu Qi, Yi Wang, Yukang Chen +4
Topological and nontopological edge states induced by qubit-assisted coupling potentials
Lu Qi, Yan Xing, Guo-Li Wang +2
LAPAR: Linearly-Assembled Pixel-Adaptive Regression Network for Single Image Super-Resolution and Beyond
Wenbo Li, Kun Zhou, Lu Qi +3
Geometry and Gradient-based Partitioning for Panoramic Outdoor Reconstruction
Weijian Chen, Weibo Yao, Yuhang Zhang +7
Watch, Remember, Reason: Human-View Video Understanding with MLLMs
Jiahao Meng, Yue Tan, Qi Xu +12
Fly360: Omnidirectional Obstacle Avoidance within Drone View
Xiangkai Zhang, Dizhe Zhang, WenZhuo Cao +5
Sa2VA: Marrying SAM2 with LLaVA for Dense Grounded Understanding of Images and Videos
Haobo Yuan, Xiangtai Li, Tao Zhang +8
Controllable double quantum state transfers by one topological channel in a frequency-modulated optomechanical array
Lu Qi, Shutian Liu, Shou Zhang +1
Dipole-phonon quantum logic with alkaline-earth monoxide and monosulfide cations
Michael Mills, Hao Wu, Evan C. Reed +6
SaSaSaSa2VA: 2nd Place of the 5th PVUW MeViS-Text Track
Dengxian Gong, Quanzhu Niu, Shihao Chen +6
Engineering of topological state transfer and topological beam splitter in an even-size Su-Schrieffer-Heeger chain
Lu Qi, Guo-Li Wang, Shutian Liu +2
D$^2$GS: Depth-and-Density Guided Gaussian Splatting for Stable and Accurate Sparse-View Reconstruction
Meixi Song, Xin Lin, Dizhe Zhang +4
Reason3D: Searching and Reasoning 3D Segmentation via Large Language Model
Kuan-Chih Huang, Xiangtai Li, Lu Qi +2
Decouple and Track: Benchmarking and Improving Video Diffusion Transformers for Motion Transfer
Qingyu Shi, Jianzong Wu, Jinbin Bai +4
High-Quality Entity Segmentation and Grounding
Lu Qi, Yi-Wen Chen, Tao Zhang +4
Rethinking Evaluation Metrics of Open-Vocabulary Segmentaion
Hao Zhou, Tiancheng Shen, Xu Yang +4
Dual Associated Encoder for Face Restoration
Yu-Ju Tsai, Yu-Lun Liu, Lu Qi +2
Magnetically guided Cesium interferometer for inertial sensing
Lu Qi, Zhaohui Hu, Tristan Valenzuela +5
MuCAN: Multi-Correspondence Aggregation Network for Video Super-Resolution
Wenbo Li, Xin Tao, Taian Guo +3
Pyramid Diffusion for Fine 3D Large Scene Generation
Yuheng Liu, Xinke Li, Xueting Li +3
Best-Buddy GANs for Highly Detailed Image Super-Resolution
Wenbo Li, Kun Zhou, Lu Qi +4
Restage4D: Reanimating Deformable 3D Reconstruction from a Single Video
Jixuan He, Chieh Hubert Lin, Lu Qi +1
DenseWorld-1M: Towards Detailed Dense Grounded Caption in the Real World
Xiangtai Li, Tao Zhang, Yanwei Li +13
Simulating Z_2 topological insulators via a one-dimensional cavity optomechanical cells array
Lu Qi, Yan Xing, Hong-Fu Wang +2
ACC for local volumes
Jingjun Han, Jihao Liu, Lu Qi
Multi-task Image Restoration Guided By Robust DINO Features
Xin Lin, Jingtong Yue, Kelvin C. K. Chan +4
Robust interface-state laser in non-Hermitian micro-resonator arrays
Lu Qi, Guo-Li Wang, Shutian Liu +2
PixelEyes: Decoupling Perception and Reasoning for Pinpoint Visual Evidence Seeking
Dengxian Gong, Yuanzheng Wu, Haobo Yuan +11
Video Prediction Transformers without Recurrence or Convolution
Yujin Tang, Lu Qi, Xiangtai Li +2
An Empirical Study of GPT-4o Image Generation Capabilities
Sixiang Chen, Jinbin Bai, Zhuoran Zhao +16
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
Rongkun Zheng, Lu Qi, Xi Chen +3
DreamRelation: Bridging Customization and Relation Generation
Qingyu Shi, Lu Qi, Jianzong Wu +4
SemFlow: Binding Semantic Segmentation and Image Synthesis via Rectified Flow
Chaoyang Wang, Xiangtai Li, Lu Qi +3
Report of the 5th PVUW Challenge: Towards More Diverse Modalities in Pixel-Level Understanding
Chang Liu, Henghui Ding, Nikhila Ravi +40
Hyperbolic Fractional Chern insulators
Ai-Lei He, Lu Qi, Yongjun Liu +1
On the geometry of spaces of filtrations on local rings
Lu Qi
Learning Deblurring Texture Prior from Unpaired Data with Diffusion Model
Chengxu Liu, Lu Qi, Jinshan Pan +2
Training Class-Imbalanced Diffusion Model Via Overlap Optimization
Divin Yan, Lu Qi, Vincent Tao Hu +2
The 1st PortraitCraft Challenge: A CVPR 2026 Workshop Competition on Portrait Composition Understanding and Generation
Zijie Lou, Youyun Tang, Xiaochao Qu +40
Dual Degradation Representation for Joint Deraining and Low-Light Enhancement in the Dark
Xin Lin, Jingtong Yue, Sixian Ding +3
Spontaneous PT symmetry breaking in non-Hermitian coupled cavities array
Yan Xing, Lu Qi, Ji Cao +5
Reference Twice: A Simple and Unified Baseline for Few-Shot Instance Segmentation
Yue Han, Jiangning Zhang, Yabiao Wang +5
Topological phase induced by distinguishing parameter regimes in cavity optomechanical system with multiple mechanical resonators
Lu Qi, Yan Xing, Shutian Liu +2
AIMS: All-Inclusive Multi-Level Segmentation
Lu Qi, Jason Kuen, Weidong Guo +5
Fully Convolutional Networks for Panoptic Segmentation with Point-based Supervision
Yanwei Li, Hengshuang Zhao, Xiaojuan Qi +6
STRNet: Visual Navigation with Spatio-Temporal Representation through Dynamic Graph Aggregation
Hao Ren, Zetong Bi, Yiming Zeng +3
SyncVIS: Synchronized Video Instance Segmentation
Rongkun Zheng, Lu Qi, Xi Chen +4
Sequential Context Encoding for Duplicate Removal
Lu Qi, Shu Liu, Jianping Shi +1
VideoAuteur: Towards Long Narrative Video Generation
Junfei Xiao, Feng Cheng, Lu Qi +5
MOSIV: Multi-Object System Identification from Videos
Chunjiang Liu, Xiaoyuan Wang, Qingran Lin +9
Frequency Domain-Based Diffusion Model for Unpaired Image Dehazing
Chengxu Liu, Lu Qi, Jinshan Pan +2
Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model
Team Seawead, Ceyuan Yang, Zhijie Lin +52
Unified Dense Prediction of Video Diffusion
Lehan Yang, Lu Qi, Xiangtai Li +3
UniSHARP: Universal Sharp Monocular View Synthesis
Meixi Song, Dizhe Zhang, Hao Ren +4
NTIRE 2025 Challenge on Day and Night Raindrop Removal for Dual-Focused Images: Methods and Results
Xin Li, Yeying Jin, Xin Jin +134
Point Cloud Mamba: Point Cloud Learning via State Space Model
Tao Zhang, Haobo Yuan, Lu Qi +5
4th PVUW MeViS 3rd Place Report: Sa2VA
Haobo Yuan, Tao Zhang, Xiangtai Li +5
SLER-IR: Spherical Layer-wise Expert Routing for All-in-One Image Restoration
Peng Shurui, Xin Lin, Shi Luo +5
AirSim360: A Panoramic Simulation Platform within Drone View
Xian Ge, Yuling Pan, Yuhang Zhang +12
SAMTok: Representing Any Mask with Two Words
Yikang Zhou, Tao Zhang, Dengxian Gong +13
Explore In-Context Segmentation via Latent Diffusion Models
Chaoyang Wang, Xiangtai Li, Henghui Ding +5
Path Aggregation Network for Instance Segmentation
Shu Liu, Lu Qi, Haifang Qin +2
PVUW 2025 Challenge Report: Advances in Pixel-level Understanding of Complex Videos in the Wild
Henghui Ding, Chang Liu, Nikhila Ravi +33
Layout-your-3D: Controllable and Precise 3D Generation with 2D Blueprint
Junwei Zhou, Xueting Li, Lu Qi +1
Enhancing In-context Panoramic Generation via Geometric-aware Pretraining
Haoran Feng, Ruiyang Zhang, Longyi Zhang +2
Rethinking Cross-Generator Image Forgery Detection through DINOv3
Zhenglin Huang, Jason Li, Haiquan Wen +7
ViLLa: Video Reasoning Segmentation with Large Language Model
Rongkun Zheng, Lu Qi, Xi Chen +4
High-Quality Entity Segmentation
Lu Qi, Jason Kuen, Weidong Guo +5
DiT360: High-Fidelity Panoramic Image Generation via Hybrid Training
Haoran Feng, Dizhe Zhang, Xiangtai Li +2
Square lattice model with staggered magnetic fluxes: zero Chern number topological states and topological flat bands
Li-Xiang Chen, Dong-Hao Guan, Lu Qi +3
UniGS: Unified Representation for Image Generation and Segmentation
Lu Qi, Lehan Yang, Weidong Guo +4
ScribbleGen: Generative Data Augmentation Improves Scribble-supervised Semantic Segmentation
Jacob Schnell, Jieke Wang, Lu Qi +2
The Ninth NTIRE 2024 Efficient Super-Resolution Challenge Report
Bin Ren, Yawei Li, Nancy Mehta +129
ACC for log canonical threshold polytopes
Jingjun Han, Zhan Li, Lu Qi
Controllable 3D Outdoor Scene Generation via Scene Graphs
Yuheng Liu, Xinke Li, Yuning Zhang +6
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
Chaoyang Wang, Xiangtai Li, Lu Qi +4
VinT-6D: A Large-Scale Object-in-hand Dataset from Vision, Touch and Proprioception
Zhaoliang Wan, Yonggen Ling, Senlin Yi +9
Stable degeneration and birational geometry
Lu Qi
RobuRCDet: Enhancing Robustness of Radar-Camera Fusion in Bird's Eye View for 3D Object Detection
Jingtong Yue, Zhiwei Lin, Xin Lin +5
Dissipation-induced topological phase transition and periodic-driving-induced photonic topological state transfer in a small optomechanical lattice
Lu Qi, Guo-Li Wang, Shutian Liu +2
Experimental evidence for dipole-phonon quantum logic in a trapped calcium monoxide and calcium ion chain
Lu Qi, Evan C. Reed, Boyan Yu +1