3 papers
cs.CV2026
CycliST: A Video Language Model Benchmark for Reasoning on Cyclical State Transitions
Simon Kohaut, Daniel Ochs, Shun Zhang +4
We present CycliST, a novel benchmark dataset designed to evaluate Video Language Models (VLM) on their ability for textual reasoning over cyclical state transitions. CycliST captu…
cs.RO2025
GundamQ: Multi-Scale Spatio-Temporal Representation Learning for Robust Robot Path Planning
Yutong Shen, Ruizhe Xia, Bokai Yan +4
In dynamic and uncertain environments, robotic path planning demands accurate spatiotemporal environment understanding combined with robust decision-making under partial observabil…
cs.LG2024
Improving Reinforcement Learning from Human Feedback with Efficient Reward Model Ensemble
Shun Zhang, Zhenfang Chen, Sunli Chen +3
Reinforcement Learning from Human Feedback (RLHF) is a widely adopted approach for aligning large language models with human values. However, RLHF relies on a reward model that is…