1 paper
Hardhik Mohanty, Indrayana Rustandi, Mohamadreza Sheibani
Large imbalanced tabular datasets make repeated gradient-boosted tree training expensive. Existing coreset methods often lose accuracy when most majority examples are removed. We p…