1 paper · 1 filter
Chenhua Shi, Gregor Macdonald, Bhavika Jalli +4
The success of large language models (LLMs) depends heavily on large-scale, high-quality instruction-following and reinforcement datasets. However, generating such data through hum…