Showing cs.ROShow all
2 papers · 1 filter
cs.RO2026
Uncertainty Quantification for Flow-Based Vision-Language-Action Models
Ralf Römer, Maximilian Seeliger, Saida Liu +5
Vision-language-action models (VLAs) combine vision-language backbones with expressive generative action heads trained via flow matching on large-scale robotic datasets. Despite th…
cs.RO2025
MATT-Diff: Multimodal Active Target Tracking by Diffusion Policy
Saida Liu, Nikolay Atanasov, Shumon Koga
This paper proposes MATT-Diff: Multimodal Active Target Tracking by Diffusion Policy, a control policy for active multi-target tracking using a mobile agent. The policy enables mul…