3 papers
cs.CV2026
TimePLE: Rethinking Temporal Representation for Video Temporal Grounding
Yuhui Zeng, Xinyu Mao, Xiaokun Liu +4
Video temporal grounding (VTG) aims to localize the continuous video interval described by a natural-language query. However, current VLM-based methods typically produce this inter…
cs.AI2026
CineCap: Structured Reasoning with Spatio-Temporal Anchors for Cinematographic Video Captioning
Xinyu Mao, Yuhui Zeng, Xiaokun Liu +6
Cinematographic captioning aims to describe how a video is filmed using professional film-language concepts such as camera movement, shot size, depth of field, composition, and sho…
cs.RO2026
Provably Safe Trajectory Generation for Manipulators Under Motion and Environmental Uncertainties
Fei Meng, Zijiang Yang, Xinyu Mao +2
Robot manipulators operating in uncertain and non-convex environments present significant challenges for safe and optimal motion planning. Existing methods often struggle to provid…