Showing cs.LGShow all
2 papers · 1 filter
cs.LG2026
Same Signal, Opposite Meaning: Direction-Informed Adaptive Learning for LLM Agents
Ziming Li, Jiatan Huang, Xiaoguang Guo +2
Adaptive test-time compute for LLM agents aims to invoke extra computation only when it improves performance. Existing methods typically use confidence-, uncertainty-, or difficult…
cs.LG2025
MARS: A Meta-Adaptive Reinforcement Learning Framework for Risk-Aware Multi-Agent Portfolio Management
Jiayi Chen, Jing Li, Guiling Wang
Reinforcement Learning (RL) has shown significant promise in automated portfolio management; however, effectively balancing risk and return remains a central challenge, as many mod…