1 paper
Vishnu Sarukkai, Brennan Shacklett, Zander Majercik +3
Large Language Models (LLMs) have the potential to automate reward engineering by leveraging their broad domain knowledge across various tasks. However, they often need many iterat…