papers
Publications (4)
cs.LG2025
RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs
Runlong Zhou, Lefan Zhang, Shang-Chen Wu +29
cs.LG2021
Intelligent Roundabout Insertion using Deep Reinforcement Learning
Alessandro Paolo Capasso, Giulio Bacchiani, Daniele Molinari
cs.LG2025
Apple Intelligence Foundation Language Models: Tech Report 2025
Ethan Li, Anders Boesen Lindbo Larsen, Chen Zhang +395
cs.MA2019
Microscopic Traffic Simulation by Cooperative Multi-agent Deep Reinforcement Learning
Giulio Bacchiani, Daniele Molinari, Marco Patander