1 paper · 1 filter
Yajing Xu, Yarong Lan, Jiaoyan Chen +6
While text-to-image models exhibit remarkable visual fidelity, they frequently violate fundamental physical commonsense. Existing benchmarks often rely on coarse-grained descriptio…