Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Surprisal-Guided Selection: Compute-Optimal Test-Time Strategies for Execution-Grounded Code Generation
Jarrod Barnes
Test-time training (TTT) adapts language models through gradient-based updates at inference. But is adaptation the right strategy? We study compute-optimal test-time strategies for…
cs.LG2025
Continual Learning, Not Training: Online Adaptation For Agents
Aman Jaglan, Jarrod Barnes
Continual Learning (CL) methods have traditionally focused on mitigating catastrophic forgetting through gradient-based retraining, an approach ill-suited for deployed agents that…