1 paper
Dulmini Hettiarachchi, Andre Rusli, Julio Christian Young +1
We present a framework that gives LLM agents two mechanisms for searching large solution spaces autonomously. First, a leaderboard scored on held-out data acts as a reward signal t…