2 papers
cs.LG2026
3SPO: State-Score-Supervised Policy Optimization for LLM Agents
Yu Han, Kailing Li, Yang Jiao +4
Training large language models (LLMs) as autonomous agents via reinforcement learning (RL) has enabled frontier models to achieve superhuman performance in long-horizon tasks. Howe…
q-bio.QM2024
GENEVIC: GENetic data Exploration and Visualization via Intelligent interactive Console
Anindita Nath, Savannah Mwesigwa, Yulin Dai +2
Summary: The vast generation of genetic data poses a significant challenge in efficiently uncovering valuable knowledge. Introducing GENEVIC, an AI-driven chat framework that tackl…