papers

Publications (171)

cs.CV2023

Q-Align: Teaching LMMs for Visual Scoring via Discrete Text-Defined Levels

Haoning Wu, Zicheng Zhang, Weixia Zhang +11

eess.IV2023

Perceptual Quality Assessment of Face Video Compression: A Benchmark and An Effective Method

Yixuan Li, Bolin Chen, Baoliang Chen +3

cs.CV2025

LPViT: Low-Power Semi-structured Pruning for Vision Transformers

Kaixin Xu, Zhe Wang, Chunyun Chen +7

cs.GR2023

The First Comprehensive Dataset with Multiple Distortion Types for Visual Just-Noticeable Differences

Yaxuan Liu, Jian Jin, Yuan Xue +1

cs.CV2017

Image Quality Assessment Guided Deep Neural Networks Training

Zhuo Chen, Weisi Lin, Shiqi Wang +2

cs.LG2025

BEAT: Balanced Frequency Adaptive Tuning for Long-Term Time-Series Forecasting

Zhixuan Li, Naipeng Chen, Seonghwa Choi +2

cs.CV2023

MetaGrad: Adaptive Gradient Quantization with Hypernetworks

Kaixin Xu, Alina Hui Xiu Lee, Ziyuan Zhao +3

cs.CV2018

Robustness Analysis of Pedestrian Detectors for Surveillance

Yuming Fang, Guanqun Ding, Yuan Yuan +2

cs.CV2025

Inspiring the Next Generation of Segment Anything Models: Comprehensively Evaluate SAM and SAM 2 with Diverse Prompts Towards Context-Dependent Concepts under Different Scenes

Xiaoqi Zhao, Youwei Pang, Shijie Chang +10

cs.CV2025

Unveiling the Underwater World: CLIP Perception Model-Guided Underwater Image Enhancement

Jiangzhong Cao, Zekai Zeng, Xu Zhang +4

cs.CV2024

Towards A Better Metric for Text-to-Video Generation

Jay Zhangjie Wu, Guian Fang, Haoning Wu +11

cs.CV2025

LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs

Zitong Xu, Huiyu Duan, Bingnan Liu +9

eess.IV2023

JND-Based Perceptual Optimization For Learned Image Compression

Feng Ding, Jian Jin, Lili Meng +1

cs.CV2022

HVS-Inspired Signal Degradation Network for Just Noticeable Difference Estimation

Jian Jin, Yuan Xue, Xingxing Zhang +3

cs.CV2018

Review of Visual Saliency Detection with Comprehensive Information

Runmin Cong, Jianjun Lei, Huazhu Fu +3

cs.CV2025

A-Bench: Are LMMs Masters at Evaluating AI-generated Images?

Zicheng Zhang, Haoning Wu, Chunyi Li +7

cs.CV2026

FakeScope: Large Multimodal Expert Model for Transparent AI-Generated Image Forensics

Yixuan Li, Yu Tian, Yipo Huang +4

cs.CV2026

NTIRE 2026 3D Restoration and Reconstruction in Real-world Adverse Conditions: RealX3D Challenge Results

Shuhong Liu, Chenyu Bao, Ziteng Cui +103

cs.CV2023

AGIQA-3K: An Open Database for AI-Generated Image Quality Assessment

Chunyi Li, Zicheng Zhang, Haoning Wu +5

cs.CV2023

Q-Instruct: Improving Low-level Visual Abilities for Multi-modality Foundation Models

Haoning Wu, Zicheng Zhang, Erli Zhang +11

cs.CV2024

Explore the Hallucination on Low-level Perception for MLLMs

Yinan Sun, Zicheng Zhang, Haoning Wu +4

cs.CV2019

A Dilated Inception Network for Visual Saliency Prediction

Sheng Yang, Guosheng Lin, Qiuping Jiang +1

cs.NI2011

Dual-Level Compressed Aggregation: Recovering Fields of Physical Quantities from Incomplete Sensory Data

Liu Xiang, Jun Luo, Chenwei Deng +2

eess.IV2024

UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content

Yuqin Cao, Xiongkuo Min, Yixuan Gao +3

cs.CV2021

Progressive Self-Guided Loss for Salient Object Detection

Sheng Yang, Weisi Lin, Guosheng Lin +2

cs.CV2026

Towards Large Model Feature Coding

Youwei Pang, Changsheng Gao, Dong Liu +2

cs.CV2025

Compressed Feature Quality Assessment: Dataset and Baselines

Changsheng Gao, Wei Zhou, Guosheng Lin +1

cs.CV2025

OmniQuality-R: Advancing Reward Models Through All-Encompassing Quality Assessment

Yiting Lu, Fengbin Guan, Yixin Gao +8

cs.IR2026

RLPO: Residual Listwise Preference Optimization for Long-Context Review Ranking

Hao Jiang, Zhi Yang, Annan Wang +2

cs.CV2025

Using GUI Agent for Electronic Design Automation

Chunyi Li, Longfei Li, Zicheng Zhang +4

cs.CV2022

SelfReformer: Self-Refined Network with Transformer for Salient Object Detection

Yi Ke Yun, Weisi Lin

cs.CV2024

IntegratedPIFu: Integrated Pixel Aligned Implicit Function for Single-view Human Reconstruction

Kennard Yanting Chan, Guosheng Lin, Haiyu Zhao +1

cs.CV2023

Q-Boost: On Visual Quality Assessment Ability of Low-level Multi-Modality Foundation Models

Zicheng Zhang, Haoning Wu, Zhongpeng Ji +9

cs.CV2022

FAST-VQA: Efficient End-to-end Video Quality Assessment with Fragment Sampling

Haoning Wu, Chaofeng Chen, Jingwen Hou +5

cs.CV2025

Image Quality Assessment for Embodied AI

Chunyi Li, Jiaohao Xiao, Jianbo Zhang +8

cs.CV2024

GMS-3DQA: Projection-based Grid Mini-patch Sampling for 3D Model Quality Assessment

Zicheng Zhang, Wei Sun, Houning Wu +5

eess.IV2026

Symmetric Entropy-Constrained Video Coding for Machines

Yuxiao Sun, Meiqin Liu, Chao Yao +5

cs.CV2024

VQA: Visual Question Answering for Video Quality Assessment

Ziheng Jia, Zicheng Zhang, Jiaying Qian +7

cs.CV2023

Towards Robust Text-Prompted Semantic Criterion for In-the-Wild Video Quality Assessment

Haoning Wu, Liang Liao, Annan Wang +5

cs.LG2026

Learning Grouped Lattice Vector Quantizers for Low-Bit LLM Compression

Xi Zhang, Xiaolin Wu, Jiamang Wang +1

eess.IV2026

CI-ICM: Channel Importance-driven Learned Image Coding for Machines

Yun Zhang, Junle Liu, Huan Zhang +3

cs.CV2022

Neighbourhood Representative Sampling for Efficient End-to-end Video Quality Assessment

Haoning Wu, Chaofeng Chen, Liang Liao +5

cs.CV2022

KSS-ICP: Point Cloud Registration based on Kendall Shape Space

Chenlei Lv, Weisi Lin, Baoquan Zhao

cs.CV2022

Minimum Noticeable Difference based Adversarial Privacy Preserving Image Generation

Wen Sun, Jian Jin, Weisi Lin

cs.CV2021

Pasadena: Perceptually Aware and Stealthy Adversarial Denoise Attack

Yupeng Cheng, Qing Guo, Felix Juefei-Xu +4

cs.MM2025

DT-UFC: Universal Large Model Feature Coding via Peaky-to-Balanced Distribution Transformation

Changsheng Gao, Zijie Liu, Li Li +3

cs.CV2017

An Iterative Co-Saliency Framework for RGBD Images

Runmin Cong, Jianjun Lei, Huazhu Fu +4

cs.HC2026

From Perception to Cognition: How Latency Affects Interaction Fluency and Social Presence in VR Conferencing

Jiarun Song, Ninghao Wan, FuZheng Yang +1

cs.CV2023

GCFAgg: Global and Cross-view Feature Aggregation for Multi-view Clustering

Weiqing Yan, Yuanyang Zhang, Chenlei Lv +4

cs.CV2026

Just Noticeable Difference Modeling for Deep Visual Features

Rui Zhao, Wenrui Li, Lin Zhu +2

cs.MM2022

Blind Quality Assessment of 3D Dense Point Clouds with Structure Guided Resampling

Wei Zhou, Qi Yang, Qiuping Jiang +2

eess.IV2021

A New Image Codec Paradigm for Human and Machine Uses

Sien Chen, Jian Jin, Lili Meng +5

eess.IV2026

KD-NVC: A Search-and-Distill Framework to Accelerate Neural Video Coding

Yuxiao Sun, Meiqin Liu, Chao Yao +6

cs.CV2024

Evolving Storytelling: Benchmarks and Methods for New Character Customization with Diffusion Models

Xiyu Wang, Yufei Wang, Satoshi Tsutsui +3

cs.GR2021

Voxel Structure-based Mesh Reconstruction from a 3D Point Cloud

Chenlei Lv, Weisi Lin, Baoquan Zhao

cs.CV2026

QD-PCQA: Quality-Aware Domain Adaptation for Point Cloud Quality Assessment

Guohua Zhang, Jian Jin, Meiqin Liu +2

cs.IR2024

MRSE: An Efficient Multi-modality Retrieval System for Large Scale E-commerce

Hao Jiang, Haoxiang Zhang, Qingshan Hou +4

cs.RO2026

MANGO-Grasp: Mahalanobis Fields over Geometry-Oriented 3D Gaussians for Cross-Embodiment Dexterous Grasping

Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou +2

cs.CV2024

Towards Open-ended Visual Quality Comparison

Haoning Wu, Hanwei Zhu, Zicheng Zhang +11

eess.IV2021

Advanced Geometry Surface Coding for Dynamic Point Cloud Compression

Jian Xiong, Hao Gao, Miaohui Wang +3

cs.RO2026

MachaGrasp: Morphology-Aware Cross-Embodiment Dexterous Hand Articulation Generation for Grasping

Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou +2

cs.AI2025

Improving AI Efficiency in Data Centres by Power Dynamic Response

Andrea Marinoni, Sai Shivareddy, Pietro Lio' +3

cs.CV2019

Cascaded Parallel Filtering for Memory-Efficient Image-Based Localization

Wentao Cheng, Weisi Lin, Kan Chen +1

cs.CV2025

Image Quality Assessment for Machines: Paradigm, Large-scale Database, and Models

Xiaoqi Wang, Yun Zhang, Weisi Lin

cs.CV2026

Control Your View: High-Resolution Global Semantic Manipulation in Learned Image Compression

Jiaming Liang, Chi-Man Pun, Weisi Lin +1

cs.CY2026

The data heat island effect: quantifying the impact of AI data centers in a warming world

Andrea Marinoni, Erik Cambria, Weisi Lin +6

cs.CV2024

Q-Refine: A Perceptual Quality Refiner for AI-Generated Image

Chunyi Li, Haoning Wu, Zicheng Zhang +7

cs.CV2025

Image Quality Assessment: From Human to Machine Preference

Chunyi Li, Yuan Tian, Xiaoyue Ling +9

cs.CV2024

Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs

Zicheng Zhang, Haoning Wu, Erli Zhang +2

cs.CV2022

Adjacent Context Coordination Network for Salient Object Detection in Optical Remote Sensing Images

Gongyang Li, Zhi Liu, Dan Zeng +2

eess.IV2022

Towards Top-Down Just Noticeable Difference Estimation of Natural Images

Qiuping Jiang, Zhentao Liu, Shiqi Wang +2

cs.CV2024

Fine Structure-Aware Sampling: A New Sampling Training Scheme for Pixel-Aligned Implicit Models in Single-View Human Reconstruction

Kennard Yanting Chan, Fayao Liu, Guosheng Lin +2

cs.MM2016

Personality, Culture, and System Factors - Impact on Affective Response to Multimedia

Sharath Chandra Guntuku, Michael James Scott, Gheorghita Ghinea +1

cs.CV2018

Learning Markov Clustering Networks for Scene Text Detection

Zichuan Liu, Guosheng Lin, Sheng Yang +3

cs.CV2024

Enhancing Diffusion Models with Text-Encoder Reinforcement Learning

Chaofeng Chen, Annan Wang, Haoning Wu +4

cs.CV2026

Skeleton-to-Image Encoding: Enabling Skeleton Representation Learning via Vision-Pretrained Models

Siyuan Yang, Jun Liu, Hao Cheng +5

cs.CV2025

Riemannian Complex Hermit Positive Definite Convolution Network for Polarimetric SAR Image Classification

Junfei Shi, Yuke Li, Mengmeng Nie +4

cs.CV2026

Real-World Scene Recovery for Scattering-Degraded Images Using Spatial and Frequency Priors

Yun Liu, Tao Li, Guanghui Yue +3

cs.CV2026

DipGuava: Disentangling Personalized Gaussian Features for 3D Head Avatars from Monocular Video

Jeonghaeng Lee, Seok Keun Choi, Zhixuan Li +2

cs.CV2024

Dual-Branch Network for Portrait Image Quality Assessment

Wei Sun, Weixia Zhang, Yanwei Jiang +8

cs.CV2024

DM3D: Distortion-Minimized Weight Pruning for Lossless 3D Object Detection

Kaixin Xu, Qingtian Feng, Hao Chen +6

cs.CV2026

Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing

Renyu Yang, Jian Jin, Lili Meng +4

cs.CV2026

Modality-Aware Feature Matching in Visual and Vision-Language Applications: A Comprehensive Survey

Weide Liu, Wei Zhou, Jun Liu +4

cs.CV2026

Current Injection Spiking Neural Network for Infrared and Visible Image Fusion

Rui Zhao, Zhuoyuan Li, Wenrui Li +4

eess.IV2021

Collaborative Intelligence: Challenges and Opportunities

Ivan V. Bajić, Weisi Lin, Yonghong Tian

cs.CV2022

Just Noticeable Difference for Deep Machine Vision

Jian Jin, Xingxing Zhang, Xin Fu +4

cs.CV2023

You Can Mask More For Extremely Low-Bitrate Image Compression

Anqi Li, Feng Li, Jiaxin Han +6

cs.MM2024

G-Refine: A General Quality Refiner for Text-to-Image Generation

Chunyi Li, Haoning Wu, Hongkun Hao +7

cs.CV2026

GT-PCQA: Geometry-Texture Decoupled Point Cloud Quality Assessment with MLLM

Guohua Zhang, Jian Jin, Meiqin Liu +3

cs.CV2026

ConceptSeg-R1: Segment Any Concept via Meta-Reinforcement Learning

Yuan Zhao, Youwei Pang, Jiaming Zuo +10

cs.CV2026

Power Battery Detection

Xiaoqi Zhao, Peiqian Cao, Chenyang Yu +10

cs.RO2026

Semantic-Contact Fields for Category-Level Generalizable Tactile Tool Manipulation

Kevin Yuchen Ma, Heng Zhang, Weisi Lin +2

cs.CV2025

DiffPCN: Latent Diffusion Model Based on Multi-view Depth Images for Point Cloud Completion

Zijun Li, Hongyu Yan, Shijie Li +4

cs.CV2025

Single Point, Full Mask: Velocity-Guided Level Set Evolution for End-to-End Amodal Segmentation

Zhixuan Li, Yujia Liu, Chen Hui +1

cs.CV2019

Towards Robust Curve Text Detection with Conditional Spatial Expansion

Zichuan Liu, Guosheng Lin, Sheng Yang +3

cs.CV2024

LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM

Zicheng Zhang, Haoning Wu, Yingjie Zhou +7

cs.CV2024

AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Yipo Huang, Quan Yuan, Xiangfei Sheng +6

cs.CV2022

Exploring the Effectiveness of Video Perceptual Representation in Blind Video Quality Assessment

Liang Liao, Kangmin Xu, Haoning Wu +4

cs.CV2026

IPDiff: Diffusion-driven ORSI Salient Object Detection with Information Reconstruction and Multi-Prior Guidance

Gongyang Li, Zhen Bai, Runmin Cong +3

cs.CV2023

Local Distortion Aware Efficient Transformer Adaptation for Image Quality Assessment

Kangmin Xu, Liang Liao, Jing Xiao +4