2 papers
cs.CV2025
Semantic-Enhanced Cross-Modal Place Recognition for Robust Robot Localization
Yujia Lin, Nicholas Evans
Ensuring accurate localization of robots in environments without GPS capability is a challenging task. Visual Place Recognition (VPR) techniques can potentially achieve this goal,…
cs.LG2025
LumiGen: An LVLM-Enhanced Iterative Framework for Fine-Grained Text-to-Image Generation
Xiaoqi Dong, Xiangyu Zhou, Nicholas Evans +1
Text-to-Image (T2I) generation has made significant advancements with diffusion models, yet challenges persist in handling complex instructions, ensuring fine-grained content contr…