CLIP integration 1diffusion models 1inference-time control 1semantic alignment 1text-to-image generation 1
From the 1 of 2 linked papers with an AI index.
2 papers
cs.CV2026
Anchoring and Steering Diffusion: Enhancing the Faithfulness of Text-to-Image Generation at Inference Time
Xinyi Wang, Yuyang Huang, Yalin Su +4
The paper introduces AnchorSteer, a training‑free method that improves text‑to‑image diffusion models by initializing with CLIP‑aligned latent noise and actively correcting semanti…
cs.CV2024
HiH: A Multi-modal Hierarchy in Hierarchy Network for Unconstrained Gait Recognition
Lei Wang, Bo Liu, Yinchi Ma +2
Gait recognition has achieved promising advances in controlled settings, yet it significantly struggles in unconstrained environments due to challenges such as view changes, occlus…