Publications (171)
Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels
Haoning Wu, Zicheng Zhang, Weixia Zhang +11
Perceptual Quality Assessment of Face Video Compression: A Benchmark and An Effective Method
Yixuan Li, Bolin Chen, Baoliang Chen +3
LPViT: Low-Power Semi-structured Pruning for Vision Transformers
Kaixin Xu, Zhe Wang, Chunyun Chen +7
The First Comprehensive Dataset with Multiple Distortion Types for Visual Just-Noticeable Differences
Yaxuan Liu, Jian Jin, Yuan Xue +1
Image Quality Assessment Guided Deep Neural Networks Training
Zhuo Chen, Weisi Lin, Shiqi Wang +2
BEAT: Balanced Frequency Adaptive Tuning for Long-Term Time-Series Forecasting
Zhixuan Li, Naipeng Chen, Seonghwa Choi +2
MetaGrad: Adaptive Gradient Quantization with Hypernetworks
Kaixin Xu, Alina Hui Xiu Lee, Ziyuan Zhao +3
Robustness Analysis of Pedestrian Detectors for Surveillance
Yuming Fang, Guanqun Ding, Yuan Yuan +2
Inspiring the Next Generation of Segment Anything Models: Comprehensively Evaluate SAM and SAM 2 with Diverse Prompts Towards Context-Dependent Concepts under Different Scenes
Xiaoqi Zhao, Youwei Pang, Shijie Chang +10
Unveiling the Underwater World: CLIP Perception Model-Guided Underwater Image Enhancement
Jiangzhong Cao, Zekai Zeng, Xu Zhang +4
Towards A Better Metric for Text-to-Video Generation
Jay Zhangjie Wu, Guian Fang, Haoning Wu +11
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
Zitong Xu, Huiyu Duan, Bingnan Liu +9
JND-Based Perceptual Optimization For Learned Image Compression
Feng Ding, Jian Jin, Lili Meng +1
HVS-Inspired Signal Degradation Network for Just Noticeable Difference Estimation
Jian Jin, Yuan Xue, Xingxing Zhang +3
Review of Visual Saliency Detection with Comprehensive Information
Runmin Cong, Jianjun Lei, Huazhu Fu +3
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
Zicheng Zhang, Haoning Wu, Chunyi Li +7
FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics
Yixuan Li, Yu Tian, Yipo Huang +4
NTIRE 2026 3D Restoration and Reconstruction in Real-world Adverse Conditions: RealX3D Challenge Results
Shuhong Liu, Chenyu Bao, Ziteng Cui +103
AGIQA-3K: An Open Database for AI-Generated Image Quality Assessment
Chunyi Li, Zicheng Zhang, Haoning Wu +5
Q-Instruct: Improving Low-level Visual Abilities for Multi-modality Foundation Models
Haoning Wu, Zicheng Zhang, Erli Zhang +11
Explore the Hallucination on Low-level Perception for MLLMs
Yinan Sun, Zicheng Zhang, Haoning Wu +4
A Dilated Inception Network for Visual Saliency Prediction
Sheng Yang, Guosheng Lin, Qiuping Jiang +1
Dual-Level Compressed Aggregation: Recovering Fields of Physical Quantities from Incomplete Sensory Data
Liu Xiang, Jun Luo, Chenwei Deng +2
UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
Yuqin Cao, Xiongkuo Min, Yixuan Gao +3
Progressive Self-Guided Loss for Salient Object Detection
Sheng Yang, Weisi Lin, Guosheng Lin +2
Towards Large Model Feature Coding
Youwei Pang, Changsheng Gao, Dong Liu +2
Compressed Feature Quality Assessment: Dataset and Baselines
Changsheng Gao, Wei Zhou, Guosheng Lin +1
OmniQuality-R: Advancing Reward Models Through All-Encompassing Quality Assessment
Yiting Lu, Fengbin Guan, Yixin Gao +8
RLPO: Residual Listwise Preference Optimization for Long-Context Review Ranking
Hao Jiang, Zhi Yang, Annan Wang +2
Using GUI Agent for Electronic Design Automation
Chunyi Li, Longfei Li, Zicheng Zhang +4
SelfReformer: Self-Refined Network with Transformer for Salient Object Detection
Yi Ke Yun, Weisi Lin
IntegratedPIFu: Integrated Pixel Aligned Implicit Function for Single-view Human Reconstruction
Kennard Yanting Chan, Guosheng Lin, Haiyu Zhao +1
Q-Boost: On Visual Quality Assessment Ability of Low-level Multi-Modality Foundation Models
Zicheng Zhang, Haoning Wu, Zhongpeng Ji +9
FAST-VQA: Efficient End-to-end Video Quality Assessment with Fragment Sampling
Haoning Wu, Chaofeng Chen, Jingwen Hou +5
Image Quality Assessment for Embodied AI
Chunyi Li, Jiaohao Xiao, Jianbo Zhang +8
GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment
Zicheng Zhang, Wei Sun, Houning Wu +5
Symmetric Entropy-Constrained Video Coding for Machines
Yuxiao Sun, Meiqin Liu, Chao Yao +5
VQA: Visual Question Answering for Video Quality Assessment
Ziheng Jia, Zicheng Zhang, Jiaying Qian +7
Towards Robust Text-Prompted Semantic Criterion for In-the-Wild Video Quality Assessment
Haoning Wu, Liang Liao, Annan Wang +5
Learning Grouped Lattice Vector Quantizers for Low-Bit LLM Compression
Xi Zhang, Xiaolin Wu, Jiamang Wang +1
CI-ICM: Channel Importance-driven Learned Image Coding for Machines
Yun Zhang, Junle Liu, Huan Zhang +3
Neighbourhood Representative Sampling for Efficient End-to-end Video Quality Assessment
Haoning Wu, Chaofeng Chen, Liang Liao +5
KSS-ICP: Point Cloud Registration based on Kendall Shape Space
Chenlei Lv, Weisi Lin, Baoquan Zhao
Minimum Noticeable Difference based Adversarial Privacy Preserving Image Generation
Wen Sun, Jian Jin, Weisi Lin
Pasadena: Perceptually Aware and Stealthy Adversarial Denoise Attack
Yupeng Cheng, Qing Guo, Felix Juefei-Xu +4
DT-UFC: Universal Large Model Feature Coding via Peaky-to-Balanced Distribution Transformation
Changsheng Gao, Zijie Liu, Li Li +3
An Iterative Co-Saliency Framework for RGBD Images
Runmin Cong, Jianjun Lei, Huazhu Fu +4
From Perception to Cognition: How Latency Affects Interaction Fluency and Social Presence in VR Conferencing
Jiarun Song, Ninghao Wan, FuZheng Yang +1
GCFAgg: Global and Cross-view Feature Aggregation for Multi-view Clustering
Weiqing Yan, Yuanyang Zhang, Chenlei Lv +4
Just Noticeable Difference Modeling for Deep Visual Features
Rui Zhao, Wenrui Li, Lin Zhu +2
Blind Quality Assessment of 3D Dense Point Clouds with Structure Guided Resampling
Wei Zhou, Qi Yang, Qiuping Jiang +2
A New Image Codec Paradigm for Human and Machine Uses
Sien Chen, Jian Jin, Lili Meng +5
KD-NVC: A Search-and-Distill Framework to Accelerate Neural Video Coding
Yuxiao Sun, Meiqin Liu, Chao Yao +6
Evolving Storytelling: Benchmarks and Methods for New Character Customization with Diffusion Models
Xiyu Wang, Yufei Wang, Satoshi Tsutsui +3
Voxel Structure-based Mesh Reconstruction from a 3D Point Cloud
Chenlei Lv, Weisi Lin, Baoquan Zhao
QD-PCQA: Quality-Aware Domain Adaptation for Point Cloud Quality Assessment
Guohua Zhang, Jian Jin, Meiqin Liu +2
MRSE: An Efficient Multi-modality Retrieval System for Large Scale E-commerce
Hao Jiang, Haoxiang Zhang, Qingshan Hou +4
MANGO-Grasp: Mahalanobis Fields over Geometry-Oriented 3D Gaussians for Cross-Embodiment Dexterous Grasping
Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou +2
Towards Open-ended Visual Quality Comparison
Haoning Wu, Hanwei Zhu, Zicheng Zhang +11
Advanced Geometry Surface Coding for Dynamic Point Cloud Compression
Jian Xiong, Hao Gao, Miaohui Wang +3
MachaGrasp: Morphology-Aware Cross-Embodiment Dexterous Hand Articulation Generation for Grasping
Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou +2
Improving AI Efficiency in Data Centres by Power Dynamic Response
Andrea Marinoni, Sai Shivareddy, Pietro Lio' +3
Cascaded Parallel Filtering for Memory-Efficient Image-Based Localization
Wentao Cheng, Weisi Lin, Kan Chen +1
Image Quality Assessment for Machines: Paradigm, Large-scale Database, and Models
Xiaoqi Wang, Yun Zhang, Weisi Lin
Control Your View: High-Resolution Global Semantic Manipulation in Learned Image Compression
Jiaming Liang, Chi-Man Pun, Weisi Lin +1
The data heat island effect: quantifying the impact of AI data centers in a warming world
Andrea Marinoni, Erik Cambria, Weisi Lin +6
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
Chunyi Li, Haoning Wu, Zicheng Zhang +7
Image Quality Assessment: From Human to Machine Preference
Chunyi Li, Yuan Tian, Xiaoyue Ling +9
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
Zicheng Zhang, Haoning Wu, Erli Zhang +2
Adjacent Context Coordination Network for Salient Object Detection in Optical Remote Sensing Images
Gongyang Li, Zhi Liu, Dan Zeng +2
Towards Top-Down Just Noticeable Difference Estimation of Natural Images
Qiuping Jiang, Zhentao Liu, Shiqi Wang +2
Fine Structure-Aware Sampling: A New Sampling Training Scheme for Pixel-Aligned Implicit Models in Single-View Human Reconstruction
Kennard Yanting Chan, Fayao Liu, Guosheng Lin +2
Personality, Culture, and System Factors - Impact on Affective Response to Multimedia
Sharath Chandra Guntuku, Michael James Scott, Gheorghita Ghinea +1
Learning Markov Clustering Networks for Scene Text Detection
Zichuan Liu, Guosheng Lin, Sheng Yang +3
Enhancing Diffusion Models with Text-Encoder Reinforcement Learning
Chaofeng Chen, Annan Wang, Haoning Wu +4
Skeleton-to-Image Encoding: Enabling Skeleton Representation Learning via Vision-Pretrained Models
Siyuan Yang, Jun Liu, Hao Cheng +5
Riemannian Complex Hermit Positive Definite Convolution Network for Polarimetric SAR Image Classification
Junfei Shi, Yuke Li, Mengmeng Nie +4
Real-World Scene Recovery for Scattering-Degraded Images Using Spatial and Frequency Priors
Yun Liu, Tao Li, Guanghui Yue +3
DipGuava: Disentangling Personalized Gaussian Features for 3D Head Avatars from Monocular Video
Jeonghaeng Lee, Seok Keun Choi, Zhixuan Li +2
Dual-Branch Network for Portrait Image Quality Assessment
Wei Sun, Weixia Zhang, Yanwei Jiang +8
DM3D: Distortion-Minimized Weight Pruning for Lossless 3D Object Detection
Kaixin Xu, Qingtian Feng, Hao Chen +6
Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing
Renyu Yang, Jian Jin, Lili Meng +4
Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey
Weide Liu, Wei Zhou, Jun Liu +4
Current Injection Spiking Neural Network for Infrared and Visible Image Fusion
Rui Zhao, Zhuoyuan Li, Wenrui Li +4
Collaborative Intelligence: Challenges and Opportunities
Ivan V. BajiÄ, Weisi Lin, Yonghong Tian
Just Noticeable Difference for Deep Machine Vision
Jian Jin, Xingxing Zhang, Xin Fu +4
You Can Mask More For Extremely Low-Bitrate Image Compression
Anqi Li, Feng Li, Jiaxin Han +6
G-Refine: A General Quality Refiner for Text-to-Image Generation
Chunyi Li, Haoning Wu, Hongkun Hao +7
GT-PCQA: Geometry-Texture Decoupled Point Cloud Quality Assessment with MLLM
Guohua Zhang, Jian Jin, Meiqin Liu +3
ConceptSeg-R1: Segment Any Concept via Meta-Reinforcement Learning
Yuan Zhao, Youwei Pang, Jiaming Zuo +10
Power Battery Detection
Xiaoqi Zhao, Peiqian Cao, Chenyang Yu +10
Semantic-Contact Fields for Category-Level Generalizable Tactile Tool Manipulation
Kevin Yuchen Ma, Heng Zhang, Weisi Lin +2
DiffPCN: Latent Diffusion Model Based on Multi-view Depth Images for Point Cloud Completion
Zijun Li, Hongyu Yan, Shijie Li +4
Single Point, Full Mask: Velocity-Guided Level Set Evolution for End-to-End Amodal Segmentation
Zhixuan Li, Yujia Liu, Chen Hui +1
Towards Robust Curve Text Detection with Conditional Spatial Expansion
Zichuan Liu, Guosheng Lin, Sheng Yang +3
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
Zicheng Zhang, Haoning Wu, Yingjie Zhou +7
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
Yipo Huang, Quan Yuan, Xiangfei Sheng +6
Exploring the Effectiveness of Video Perceptual Representation in Blind Video Quality Assessment
Liang Liao, Kangmin Xu, Haoning Wu +4
IPDiff: Diffusion-driven ORSI Salient Object Detection with Information Reconstruction and Multi-Prior Guidance
Gongyang Li, Zhen Bai, Runmin Cong +3
Local Distortion Aware Efficient Transformer Adaptation for Image Quality Assessment
Kangmin Xu, Liang Liao, Jing Xiao +4