1 paper · 1 filter
Kai Fronsdal, David Lindner
We propose a suite of tasks to evaluate the instrumental self-reasoning ability of large language model (LLM) agents. Instrumental self-reasoning ability could improve adaptability…