2 papers
cs.LG2025
Revisiting Group Relative Policy Optimization: Insights into On-Policy and Off-Policy Training
Youssef Mroueh, Nicolas Dupuis, Brian Belgodere +6
We revisit Group Relative Policy Optimization (GRPO) in both on-policy and off-policy optimization regimes. Our motivation comes from recent work on off-policy Proximal Policy Opti…
q-bio.BM2025
GP-MoLFormer: A Foundation Model For Molecular Generation
Jerret Ross, Brian Belgodere, Samuel C. Hoffman +4
Transformer-based models trained on large and general purpose datasets consisting of molecular strings have recently emerged as a powerful tool for successfully modeling various st…