papers

Publications (15)

cs.CV2024

BaFTA: Backprop-Free Test-Time Adaptation For Zero-Shot Vision-Language Models

Xuefeng Hu, Ke Zhang, Min Sun +3

cs.CV2024

InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning

Xiaotian Han, Yiren Jian, Xuefeng Hu +8

cs.CV2026

ARM: An AutoRegressive Large Multimodal Model with Unified Discrete Representations

Junke Wang, Xiao Wang, Jiacheng Pan +16

cs.CV2025

DiCo: Revitalizing ConvNets for Scalable and Efficient Diffusion Modeling

Yuang Ai, Qihang Fan, Xuefeng Hu +3

cs.CV2024

Large Language Models are Good Prompt Learners for Low-Shot Image Classification

Zhaoheng Zheng, Jingmin Wei, Xuefeng Hu +2

cs.CV2022

SimPLE: Similar Pseudo Label Exploitation for Semi-Supervised Classification

Zijian Hu, Zhengyu Yang, Xuefeng Hu +1

cs.CV2023

ReCLIP: Refine Contrastive Language Image Pre-Training with Source Free Domain Adaptation

Xuefeng Hu, Ke Zhang, Lu Xia +9

cs.CV2021

MixNorm: Test-Time Adaptation Through Online Normalization Estimation

Xuefeng Hu, Gokhan Uzunbas, Sirius Chen +4

cs.CV2023

Efficient Feature Distillation for Zero-shot Annotation Object Detection

Zhuoming Liu, Xuefeng Hu, Ram Nevatia

cs.CV2021

SPAN: Spatial Pyramid Attention Network forImage Manipulation Localization

Xuefeng Hu, Zhihan Zhang, Zhenye Jiang +3

cs.CV2026

BitDance: Scaling Autoregressive Generative Models with Binary Tokens

Yuang Ai, Jiaming Han, Shaobin Zhuang +8

cs.CV2026

Implicit Neural Representation Facilitates Unified Universal Vision Encoding

Matthew Gwilliam, Xiao Wang, Xuefeng Hu +1

cs.CL2026

BitLM: Unlocking Multi-Token Language Generation with Bitwise Continuous Diffusion

Shaobin Zhuang, Yuang Ai, Jiaming Han +7

cs.RO2022

SPARCS: Structuring Physically Assistive Robotics for Caregiving with Stakeholders-in-the-loop

Rishabh Madan, Rajat Kumar Jenamani, Vy Thuy Nguyen +4

cs.CV2019

Unsupervised Rank-Preserving Hashing for Large-Scale Image Retrieval

Svebor Karaman, Xudong Lin, Xuefeng Hu +1