Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
Modular Diffusion Models for Structured Visual Recognition
Siddhesh Khandelwal, Björn Ommer, Leonid Sigal
Traditional supervised methods for structured visual recognition tasks -- such as object detection, segmentation, and scene graph generation -- often produce deterministic, fixed o…
cs.CV2024
Unsupervised View-Invariant Human Posture Representation
Faegheh Sardari, Björn Ommer, Majid Mirmehdi
Most recent view-invariant action recognition and performance assessment approaches rely on a large amount of annotated 3D skeleton data to extract view-invariant features. However…