Publications (39)
GraSP-VL: Length as a Semantic Granularity Interface for Vision-Language Representations
Zesheng Li, Chengchang Pan, Honggang Qi
Cross-Tokenizer On-Policy Distillation via Byte-Prefix Marginalization
Hao Wang, Kun Yuan, Wenlin Zhong +4
Active Fake: DeepFake Camouflage
Pu Sun, Honggang Qi, Yuezun Li
DynSegNet:Dynamic Architecture Adjustment for Adversarial Learning in Segmenting Hemorrhagic Lesions from Fundus Images
Zesheng Li, Minwen Liao, Haoran Chen +3
Multi-Scale Supervised Network for Human Pose Estimation
Lipeng Ke, Ming-Ching Chang, Honggang Qi +1
PupiNet: Seamless OCT-OCTA Interconversion Through Wavelet-Driven and Multi-Scale Attention Mechanisms
Renzhi Tian, Jinjie Wang, Wei Yang +5
DeepFake-o-meter: An Open Platform for DeepFake Detection
Yuezun Li, Cong Zhang, Pu Sun +2
CenterNet++ for Object Detection
Kaiwen Duan, Song Bai, Lingxi Xie +3
RURA-Net: A general disease diagnosis method based on Zero-Shot Learning
Yan Su, Qiulin Wu, Weizhen Li +2
HER2 Expression Prediction with Flexible Multi-Modal Inputs via Dynamic Bidirectional Reconstruction
Jie Qin, Wei Yang, Yan Su +5
CenterNet: Keypoint Triplets for Object Detection
Kaiwen Duan, Song Bai, Lingxi Xie +3
Dynamic Knowledge Exchange and Dual-diversity Review: Concisely Unleashing the Potential of a Multi-Agent Research Team
Weilun Yu, Shixiang Tang, Yonggui Huang +7
Celeb-DF: A Large-scale Challenging Dataset for DeepFake Forensics
Yuezun Li, Xin Yang, Pu Sun +2
Improving Image Restoration with Soft-Rounding
Xing Mei, Honggang Qi, Bao-Gang Hu +1
MEMTS: Internalizing Domain Knowledge via Parameterized Memory for Retrieval-Free Domain Adaptation of Time Series Foundation Models
Xiaoyun Yu, Li fan, Xiangfei Qiu +7
Corner Proposal Network for Anchor-free, Two-stage Object Detection
Kaiwen Duan, Lingxi Xie, Honggang Qi +3
Exposing GAN-synthesized Faces Using Landmark Locations
Xin Yang, Yuezun Li, Honggang Qi +1
A Dynamic Prognostic Prediction Method for Colorectal Cancer Liver Metastasis
Wei Yang, Yiran Zhu, Yan su +3
4D-ACFNet: A 4D Attention Mechanism-Based Prognostic Framework for Colorectal Cancer Liver Metastasis Integrating Multimodal Spatiotemporal Features
Zesheng Li, Wei Yang, Yan Su +5
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
Hao Wang, Guozhi Wang, Han Xiao +8
COMICS: End-to-end Bi-grained Contrastive Learning for Multi-face Forgery Detection
Cong Zhang, Honggang Qi, Shuhui Wang +2
FakeTracer: Catching Face-swap DeepFakes via Implanting Traces in Training
Pu Sun, Honggang Qi, Yuezun Li +1
See Better Before Looking Closer: Weakly Supervised Data Augmentation Network for Fine-Grained Visual Classification
Tao Hu, Honggang Qi, Qingming Huang +1
Facial Landmarks Detection by Self-Iterative Regression based Landmarks-Attention Network
Tao Hu, Honggang Qi, Jizheng Xu +1
Contrast Enhancement Estimation for Digital Image Forensics
Longyin Wen, Honggang Qi, Siwei Lyu
Geometric Hypergraph Learning for Visual Tracking
Dawei Du, Honggang Qi, Longyin Wen +3
RURANET++: An Unsupervised Learning Method for Diabetic Macular Edema Based on SCSE Attention Mechanisms and Dynamic Multi-Projection Head Clustering
Wei Yang, Yiran Zhu, Jiayu Shen +5
Weakly Supervised Bilinear Attention Network for Fine-Grained Visual Classification
Tao Hu, Jizheng Xu, Cong Huang +3
Behavior-Guided Candidate Calibration for Multimodal Recommendation
Zesheng Li, Chengchang Pan, Honggang Qi
Landmark Breaker: Obstructing DeepFake By Disturbing Landmark Extraction
Pu Sun, Yuezun Li, Honggang Qi +1
A Residual Multi-task Network for Joint Classification and Regression in Medical Imaging
Junji Lin, Yi Zhang, Yunyue Pan +3
Location-Sensitive Visual Recognition with Cross-IOU Loss
Kaiwen Duan, Lingxi Xie, Honggang Qi +3
RetinaRegen: A Hybrid Model for Readability and Detail Restoration in Fundus Images
Yuhan Tang, Yudian Wang, Weizhen Li +3
UA-DETRAC: A New Benchmark and Protocol for Multi-Object Detection and Tracking
Longyin Wen, Dawei Du, Zhaowei Cai +6
Multi-Scale Structure-Aware Network for Human Pose Estimation
Lipeng Ke, Ming-Ching Chang, Honggang Qi +1
LandmarkGAN: Synthesizing Faces from Landmarks
Pu Sun, Yuezun Li, Honggang Qi +1
Automatic Block-wise Pruning with Auxiliary Gating Structures for Deep Convolutional Neural Networks
Zhaofeng Si, Honggang Qi, Xiaoyu Song
Hints of Prompt: Enhancing Visual Representation for Multimodal LLMs in Autonomous Driving
Hao Zhou, Zhanning Gao, Zhili Chen +4
A Diffusion Model Based Quality Enhancement Method for HEVC Compressed Video
Zheng Liu, Honggang Qi