8 papers
Symmetric Entropy-Constrained Video Coding for Machines
Yuxiao Sun, Meiqin Liu, Chao Yao +5
As video transmission increasingly serves machine vision systems (MVS) instead of human vision systems (HVS), video coding for machines (VCM) has become a critical research topic.…
KD-NVC: A Search-and-Distill Framework to Accelerate Neural Video Coding
Yuxiao Sun, Meiqin Liu, Chao Yao +6
While neural video coding (NVC) has achieved remarkable rate-distortion performance, real-time decoding on edge devices has become an important demand but remains limited by high c…
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
Jiacheng Shi, Hongfei Du, Xinyuan Song +3
Neural speech codecs provide discrete representations for speech language models, but emotional cues are often degraded during quantization. Existing codecs mainly optimize acousti…
Control Your View: High-Resolution Global Semantic Manipulation in Learned Image Compression
Jiaming Liang, Chi-Man Pun, Weisi Lin +1
Learned image compression (LIC) integrates deep neural networks (DNNs) to map high-dimensional images into compact latent representations, reducing redundancy and achieving superio…
GT-PCQA: Geometry-Texture Decoupled Point Cloud Quality Assessment with MLLM
Guohua Zhang, Jian Jin, Meiqin Liu +3
With the rapid advancement of Multi-modal Large Language Models (MLLMs), MLLM-based Image Quality Assessment (IQA) methods have shown promising generalization. However, directly ex…
Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing
Renyu Yang, Jian Jin, Lili Meng +4
Audio-visual quality assessment (AVQA) research has been stalled by limitations of existing datasets: they are typically small in scale, with insufficient diversity in content and…