1 paper
Zisheng Chen, Chunwei Wang, Runhui Huang +6
In this paper, we introduce SemHiTok, a unified image Tokenizer via Semantic-Guided Hierarchical codebook that provides consistent discrete representations for multimodal understan…