3 papers
cs.CV2026
SpatialFlow-GRPO: Where Spatial Credit Drives Image Editing
Yankai Yang, Yancheng Long, Wei Chen +7
Recent online reinforcement learning has substantially improved image editing quality. However, existing Flow-GRPO-style methods usually rely on a single whole-image reward, which…
cs.LG2026
MiniOpt: Reasoning to Model and Solve General Optimization Problems with Limited Resources
Ke Zhao, Zixiang Di, Hong Qian +9
Achieving strong optimization generalization across diverse optimization problems while requiring limited training resources remains a challenging problem for optimization-oriented…
cs.RO2026
Primary-Fine Decoupling for Action Generation in Robotic Imitation
Xiaohan Lei, Min Wang, Wengang Zhou +2
Multi-modal distribution in robotic manipulation action sequences poses critical challenges for imitation learning. To this end, existing approaches often model the action space as…