1 paper · 1 filter
Kepeng Xu, Li Xu, Gang He +1
Vision-language models typically reason over post-ISP RGB images, although RGB rendering can clip, suppress, or quantize sensor evidence before inference. We study whether groundin…