Publications (18)
Digging into Depth Priors for Outdoor Neural Radiance Fields
Chen Wang, Jiadai Sun, Lina Liu +5
Hallucinations Leave a Grounding Signature:Verifier-Guided Decoding for Selective Object Correction
Lei Yang, Xinze Liu, Dayan Wu +7
The paper introduces a method to detect and correct hallucinated objects in large vision‑language models by identifying a hidden grounding pattern and using a lightweight verifier…
Online Self-Calibration Against Hallucination in Vision-Language Models
Minghui Chen, Chenxu Yang, Hengjie Zhu +3
TPSNet: Reverse Thinking of Thin Plate Splines for Arbitrary Shape Scene Text Representation
Wei Wang, Yu Zhou, Jiahao Lv +4
Prediction Exposes Your Face: Black-box Model Inversion via Prediction Alignment
Yufan Liu, Wanqian Zhang, Dayan Wu +3
Critique Before Thinking: Mitigating Hallucination through Rationale-Augmented Instruction Tuning
Zexian Yang, Dian Li, Dayan Wu +2
Beyond Post-Quantization: Native Hash Learning with a Dedicated HASH Token
Xinze Liu, Ding Wang, Hengjie Zhu +4
FC2RN: A Fully Convolutional Corner Refinement Network for Accurate Multi-Oriented Scene Text Detection
Xugong Qin, Yu Zhou, Dayan Wu +2
NeuS-PIR: Learning Relightable Neural Surface using Pre-Integrated Rendering
Shi Mao, Chenming Wu, Zhelun Shen +3
Rescuing Deep Hashing from Dead Bits Problem
Shu Zhao, Dayan Wu, Yucan Zhou +2
EagleNet: Energy-Aware Fine-Grained Relationship Learning Network for Text-Video Retrieval
Yuhan Chen, Pengwen Dai, Chuan Wang +2
Handling Label Uncertainty for Camera Incremental Person Re-Identification
Zexian Yang, Dayan Wu, Wanqian Zhang +2
RealEra: Semantic-level Concept Erasure via Neighbor-Concept Mining
Yufan Liu, Jinyang An, Wanqian Zhang +5
Exploring Relations in Untrimmed Videos for Self-Supervised Learning
Dezhao Luo, Bo Fang, Yu Zhou +3
Two-Level Residual Distillation based Triple Network for Incremental Object Detection
Dongbao Yang, Yu Zhou, Dayan Wu +3
Imagine by Reasoning: A Reasoning-Based Implicit Semantic Data Augmentation for Long-Tailed Classification
Xiaohua Chen, Yucan Zhou, Dayan Wu +4
Disrupting Diffusion: Token-Level Attention Erasure Attack against Diffusion-based Customization
Yisu Liu, Jinyang An, Wanqian Zhang +4
Mask is All You Need: Rethinking Mask R-CNN for Dense and Arbitrary-Shaped Scene Text Detection
Xugong Qin, Yu Zhou, Youhui Guo +5