papers
Publications (15)
cs.CV2024
BaFTA: Backprop-Free Test-Time Adaptation For Zero-Shot Vision-Language Models
Xuefeng Hu, Ke Zhang, Min Sun +3
cs.CV2024
InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning
Xiaotian Han, Yiren Jian, Xuefeng Hu +8
cs.CV2026
ARM: An AutoRegressive Large Multimodal Model with Unified Discrete Representations
Junke Wang, Xiao Wang, Jiacheng Pan +16
cs.CV2025
DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion Modeling
Yuang Ai, Qihang Fan, Xuefeng Hu +3
cs.CV2024
Large Language Models are Good Prompt Learners for Low-Shot Image Classification
Zhaoheng Zheng, Jingmin Wei, Xuefeng Hu +2
cs.CV2022
SimPLE: Similar Pseudo Label Exploitation for Semi-Supervised Classification
Zijian Hu, Zhengyu Yang, Xuefeng Hu +1
cs.CV2023
ReCLIP: Refine Contrastive Language Image Pre-Training with Source Free Domain Adaptation
Xuefeng Hu, Ke Zhang, Lu Xia +9
cs.CV2021
MixNorm: Test-Time Adaptation Through Online Normalization Estimation
Xuefeng Hu, Gokhan Uzunbas, Sirius Chen +4
cs.CV2023
Efficient Feature Distillation for Zero-shot Annotation Object Detection
Zhuoming Liu, Xuefeng Hu, Ram Nevatia
cs.CV2021
SPAN: Spatial Pyramid Attention Network forImage Manipulation Localization
Xuefeng Hu, Zhihan Zhang, Zhenye Jiang +3
cs.CV2026
BitDance: Scaling Autoregressive Generative Models with Binary Tokens
Yuang Ai, Jiaming Han, Shaobin Zhuang +8
cs.CV2026
Implicit Neural Representation Facilitates Unified Universal Vision Encoding
Matthew Gwilliam, Xiao Wang, Xuefeng Hu +1
cs.CL2026
BitLM: Unlocking Multi-Token Language Generation with Bitwise Continuous Diffusion
Shaobin Zhuang, Yuang Ai, Jiaming Han +7
cs.RO2022
SPARCS: Structuring Physically Assistive Robotics for Caregiving with Stakeholders-in-the-loop
Rishabh Madan, Rajat Kumar Jenamani, Vy Thuy Nguyen +4
cs.CV2019
Unsupervised Rank-Preserving Hashing for Large-Scale Image Retrieval
Svebor Karaman, Xudong Lin, Xuefeng Hu +1