1 paper · 1 filter
Cheng Qian, Emre Can Acikgoz, Qi He +5
Current Large Language Models (LLMs) often undergo supervised fine-tuning (SFT) to acquire tool use capabilities. However, SFT struggles to generalize to unfamiliar or complex tool…