3 papers
cs.CL2026
GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
Minxuan Lv, Tiehua Mei, Tanlong Du +9
We present GoLongRL, a fully open-source, capability-oriented post-training recipe for long-context reinforcement learning with verifiable rewards (RLVR). Existing long-context RL…
cs.LG2025
BSL: A Unified and Generalizable Multitask Learning Platform for Virtual Drug Discovery from Design to Synthesis
Kun Li, Zhennan Wu, Yida Xiong +8
Drug discovery is of great social significance in safeguarding human health, prolonging life, and addressing the challenges of major diseases. In recent years, artificial intellige…
cs.AI2025
DrugPilot: LLM-based Parameterized Reasoning Agent for Drug Discovery
Kun Li, Zhennan Wu, Shoupeng Wang +3
Large language models (LLMs) integrated with autonomous agents hold significant potential for advancing scientific discovery through automated reasoning and task execution. However…