2 papers
cs.CV2026
MLCR: Multi-Level Cue Refinement for Long-Term Multimodal Action Quality Assessment
Qiqi Li, Pengfei Wang, Hongyu Chen +1
Long-term multimodal action quality assessment (AQA) evaluates action execution in several-minute audiovisual sequences by mining discriminative quality cues for score prediction.…
cs.AI2026
Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief
Hongqiang Lin, Pengfei Wang, Nenggan Zheng
Offline reinforcement learning (RL) aims to optimize policies from pre-collected datasets. A bottleneck of this paradigm is managing epistemic uncertainty, which arises from limite…