1 paper
Jiacong Liu, Shu Luo, Yikai Qin +3
Vision-language foundation models have shown promising zero-shot generalization for Cross-Domain Few-Shot Object Detection (CD-FSOD). However, they face two critical challenges in…