2 papers
cs.CV2026
OP-GRPO: Efficient Off-Policy GRPO for Flow-Matching Models
Liyu Zhang, Kehan Li, Tingrui Han +4
Post training via GRPO has demonstrated remarkable effectiveness in improving the generation quality of flow-matching models. However, GRPO suffers from inherently low sample effic…
cs.RO2025
Collaborate sim and real: Robot Bin Packing Learning in Real-world and Physical Engine
Lidi Zhang, Han Wu, Liyu Zhang +6
The 3D bin packing problem, with its diverse industrial applications, has garnered significant research attention in recent years. Existing approaches typically model it as a discr…