papers

Publications (22)

cs.LG2025

ScalingNoise: Scaling Inference-Time Search for Generating Infinite Videos

Haolin Yang, Feilong Tang, Ming Hu +8

cs.CV2024

OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining

Ming Hu, Kun Yuan, Yaling Shen +17

cs.CV2025

MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models

Yu Huang, Zelin Peng, Yichen Zhao +3

cs.CV2023

A Survey on Label-efficient Deep Image Segmentation: Bridging the Gap between Weak Supervision and Dense Prediction

Wei Shen, Zelin Peng, Xuehui Wang +6

cs.CV2024

Parameter Efficient Fine-tuning via Cross Block Orchestration for Segment Anything Model

Zelin Peng, Zhengqin Xu, Zhilin Zeng +3

cs.CV2025

HyperET: Efficient Training in Hyperbolic Space for Multi-modal Large Language Models

Zelin Peng, Zhengqin Xu, Qingyang Liu +2

cs.CV2026

AnimateScene: Camera-controllable Animation in Any Scene

Qingyang Liu, Bingjie Gao, Weiheng Huang +10

cs.CV2026

Unlocking 3D Affordance Segmentation with 2D Semantic Knowledge

Yu Huang, Zelin Peng, Changsong Wen +2

cs.CV2025

PG-SAM: Prior-Guided SAM with Medical for Multi-organ Segmentation

Yiheng Zhong, Zihong Luo, Chengzhi Liu +7

cs.CL2026

Why Struggle with Continuous Latents? Interpretable Discrete Latent Reasoning via Rendered Compression

Shuochen Chang, Qingyang Liu, Shaobo Wang +8

cs.CV2023

Absolute Wrong Makes Better: Boosting Weakly Supervised Object Detection via Negative Deterministic Information

Guanchun Wang, Xiangrong Zhang, Zelin Peng +3

cs.CV2021

Adaptive Affinity Loss and Erroneous Pseudo-Label Refinement for Weakly Supervised Semantic Segmentation

Xiangrong Zhang, Zelin Peng, Peng Zhu +4

cs.CV2025

ACMamba: Fast Unsupervised Anomaly Detection via An Asymmetrical Consensus State Space Model

Guanchun Wang, Xiangrong Zhang, Yifei Zhang +4

cs.CV2025

OneCAT: Decoder-Only Auto-Regressive Model for Unified Understanding and Generation

Han Li, Xinyu Peng, Yaoming Wang +7

cs.CV2025

Seeing Far and Clearly: Mitigating Hallucinations in MLLMs with Attention Causal Decoding

Feilong Tang, Chengzhi Liu, Zhongxing Xu +9

cs.CV2023

SAM-PARSER: Fine-tuning SAM Efficiently by Parameter Space Reconstruction

Zelin Peng, Zhengqin Xu, Zhilin Zeng +2

cs.CV2026

Seeking Consensus: Geometric-Semantic On-the-Fly Recalibration for Open-Vocabulary Remote Sensing Semantic Segmentation

Guanchun Wang, Chenxiao Wu, Xiangrong Zhang +4

cs.CV2026

NEARL: Interacted Query Adaptation with Orthogonal Regularization for Medical Vision-Language Understanding

Zelin Peng, Yichen Zhao, Yu Huang +5

cs.CV2024

SMamba: A Spatial-spectral State Space Model for Hyperspectral Image Classification

Guanchun Wang, Xiangrong Zhang, Zelin Peng +2

cs.CV2024

Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation

Zelin Peng, Zhengqin Xu, Zhilin Zeng +2

cs.CV2023

USAGE: A Unified Seed Area Generation Paradigm for Weakly Supervised Semantic Segmentation

Zelin Peng, Guanchun Wang, Lingxi Xie +3

cs.CV2026

MMRad-22K: A Structured Multimodal Evidence Dataset for Chest X-ray Report Generation

Yichen Zhao, Zelin Peng, Fenghe Tang +3