1 paper
Pranav Shetty, Mirazul Haque, Zhiqiang Ma +1
As large language models (LLMs) are trained on increasingly vast and opaque text corpora, determining which data contributed to training has become essential for copyright enforcem…