3 papers
cs.LG2026
Learning to Staff: Offline Reinforcement Learning and Fine-Tuned LLMs for Warehouse Staffing Optimization
Kalle Kujanpää, Yuying Zhu, Kristina Klinkner +1
We investigate machine learning approaches for optimizing real-time staffing decisions in semi-automated warehouse sortation systems. Operational decision-making can be supported a…
cs.LG2025
Hurdle-IMDL: An Imbalanced Learning Framework for Infrared Rainfall Retrieval
Fangjian Zhang, Xiaoyong Zhuge, Wenlan Wang +3
Artificial intelligence has advanced quantitative remote sensing, yet its effectiveness is constrained by imbalanced label distribution. This imbalance leads conventionally trained…
cs.CV2025
BranchGRPO: Stable and Efficient GRPO with Structured Branching in Diffusion Models
Yuming Li, Yikai Wang, Yuying Zhu +4
Recent progress in aligning image and video generative models with Group Relative Policy Optimization (GRPO) has improved human preference alignment, but existing variants remain i…