1 paper
Yungi Kim, Hyunsoo Ha, Seonghoon Yang +3
Creating high-quality, large-scale datasets for large language models (LLMs) often relies on resource-intensive, GPU-accelerated models for quality filtering, making the process ti…