1 paper
Ruoxi Zhao, Maziar Raissi
Evaluating LLM coding agents in algorithmic trading is difficult because static benchmarks risk data contamination and numerical backtest outputs require ground truth from actual c…