3 papers
cs.CV2025
RoboEnvision: A Long-Horizon Video Generation Model for Multi-Task Robot Manipulation
Liudi Yang, Yang Bai, George Eskandar +7
We address the problem of generating long-horizon videos for robotic manipulation tasks. Text-to-video diffusion models have made significant progress in photorealism, language und…
cs.CV2025
CE-NPBG: Connectivity Enhanced Neural Point-Based Graphics for Novel View Synthesis in Autonomous Driving Scenes
Mohammad Altillawi, Fengyi Shen, Liudi Yang +2
Current point-based approaches encounter limitations in scalability and rendering quality when using large 3D point cloud maps because using them directly for novel view synthesis…
cs.CV2023
Long-Term Invariant Local Features via Implicit Cross-Domain Correspondences
Zador Pataki, Mohammad Altillawi, Menelaos Kanakis +5
Modern learning-based visual feature extraction networks perform well in intra-domain localization, however, their performance significantly declines when image pairs are captured…